Por que a Perissol — e não
uma plataforma ou uma grande consultoria
Não vendemos dashboards que você vai abandonar em seis meses. Não entregamos relatórios que a equipe não sabe usar. Estruturamos um processo que fica com você.
Voltar ao InícioSeis razões que fazem diferença no dia a dia
Baseline antes de qualquer solução
Mapeamos o que você já mede antes de propor qualquer mudança. O diagnóstico é o ponto de partida — não uma venda embrulhada em auditoria.
Referências do seu próprio histórico
Os casos de referência vêm do uso real do seu sistema — não de benchmarks públicos desconectados do contexto da sua aplicação.
Rubrica calibrada com sua equipe
O critério de avaliação é acordado antes de qualquer execução. Nada é pontuado por métrica que sua equipe não reconheça como relevante.
Responsável nomeado em cada limiar
O registro de limiares indica por função quem age quando uma medida sai da faixa — parte de todo Retainer que entregamos.
Formato fixo para comparação
Cada execução usa o mesmo formato de registro — data, versão do modelo, conjunto de referência e pontuação. Comparar resultados de versões diferentes é direto.
Transferência real, não dependência
O Harness é entregue com sessão de calibração e documentação para que sua equipe possa operá-lo — não precisamos estar presentes para cada execução.
Cada diferencial em profundidade
Especialização em avaliação operacional
A Perissol trabalha exclusivamente com observabilidade e avaliação de modelos de linguagem em produção. Não somos uma consultoria de IA generalista que inclui avaliação como um serviço adicional — é o único foco do nosso trabalho desde 2021.
- Quatro anos de engajamentos exclusivamente em avaliação de sistemas de linguagem
- Equipe com histórico em instrumentação de sistemas distribuídos
- Metodologia desenvolvida a partir de padrões de engenharia, não de benchmarks acadêmicos
Processo em etapas com entregável definido
Cada serviço tem um escopo escrito, duração definida e entregável claro. Nenhum engajamento é aberto — você sabe antes de começar o que vai receber e quando.
- Documento de escopo aprovado antes do início
- Baseline em três semanas, Harness em quatro a seis semanas
- Relatório escrito ao final de cada fase
Atendimento direto com quem executa
Não há camada de gestão de conta separada da equipe técnica. Quem você fala no primeiro contato é quem conduz o engajamento — sem repasse interno ou intermediários.
- Contato direto com o engenheiro responsável
- Atendimento em português, sem barreiras de idioma ou fuso
- Resposta a dúvidas operacionais incluída no Retainer
Preço fixo com escopo definido
Os três serviços têm preços publicados — R$ 890, R$ 2.940 e R$ 5.280 — sem variáveis por hora ou surpresas no final do engajamento. O que está no escopo é o que está coberto.
- Preço listado antes do contato
- Sem cobrança por hora adicional dentro do escopo
- Retainer inclui sessões trimestrais e suporte de limiar
Resultados que a equipe consegue usar
Entregamos documentos escritos e conjuntos de referência — não dashboards proprietários. Os resultados ficam em formatos que sua equipe de engenharia já usa: tabelas, planilhas, documentos de texto.
- Harness compatível com qualquer pipeline de CI existente
- Sem ferramenta adicional para instalar ou manter
- Registro em formato que sua equipe já conhece
Abordagem típica vs. abordagem Perissol
| Aspecto | Abordagem comum | Perissol |
|---|---|---|
| Ponto de partida | Proposta de plataforma ou metodologia | Mapeamento do que já existe |
| Casos de referência | Benchmarks públicos genéricos | Histórico real do seu sistema |
| Critério de pontuação | Métrica automática sem calibração | Rubrica acordada com a equipe responsável |
| Responsabilidade | Alerta sem responsável definido | Nome e função em cada limiar |
| Entregável | Dashboard em ferramenta proprietária | Documentos que ficam com sua equipe |
| Preço | Por hora ou assinatura crescente | Fixo, publicado antes do contato |
O que você não encontra em outro lugar
Um padrão de documentação que registra quando uma medida se moveu pela última vez e o que foi alterado em resposta — parte de cada Retainer mensal. Nenhuma ferramenta de mercado gera isso automaticamente porque exige julgamento humano.
Uma tabela mantida por sistema em produção com cada medida, sua faixa aceitável, o responsável por função e a ação padrão quando o limiar é cruzado. Desenvolvido e mantido ao longo do Retainer.
Extraímos casos de referência diretamente dos seus logs históricos de produção — não de datasets públicos. Isso significa que o conjunto de avaliação testa o que o modelo precisa fazer de verdade.
Todo o trabalho — documentos, sessões, relatórios — é conduzido em português. Sem barreiras de idioma para equipes brasileiras que trabalham com modelos multilíngues ou focados em português.
Números que refletem o trabalho acumulado
A Perissol foi citada entre iniciativas de operações de avaliação de IA no Brasil pelo levantamento anual da Associação Brasileira de Risco em Inteligência Artificial.
Integramos a rede desde sua formação, contribuindo com padrões de documentação para avaliação de sistemas de linguagem em contextos de produção.
Quer ver se esses diferenciais fazem sentido para o seu contexto?
Uma conversa de meia hora sobre os seus sistemas em produção já é suficiente para entender qual serviço se encaixa — ou se o momento não é o certo ainda.
Solicitar Conversa