Pular para o conteúdo

Typesafe AI (decisões com confiança)

Dentro do Context Code há dezenas de decisões pequenas que não são tomadas pelo modelo do chat: qual modelo usar neste turno, quais skills são relevantes, se uma ferramenta é perigosa, quais especialistas montar em um plano. Até agora elas eram decididas com listas de palavras-chave e pesos escritos à mão. Funcionam pela metade: «preciso entender o fluxo de login» não contém nenhuma palavra «informativa» e acabava forçando um plano; qualquer frase que mencionasse «api» de passagem disparava a equipe de engenharia.

O Typesafe AI é um serviço feito exatamente para isso: você envia um estado (o texto do pedido, o nome de uma ferramenta, a lista de skills) e uma pergunta, e ele devolve a resposta com um número de confiança. O Context Code só segue a resposta quando essa confiança é alta; abaixo do limite, volta à heurística de sempre.

É opcional. Sem chave, o app se comporta exatamente como antes.

  1. Crie uma conta em console.typesafe.ai e abra Keys (console.typesafe.ai/keys).
  2. Gere uma chave nova e copie.
  3. No Context Code, abra Configurações e procure a seção Typesafe. Cole a chave e salve.

A chave fica no armazenamento cifrado do aplicativo, o mesmo onde vivem as credenciais dos seus provedores de IA: não é escrita em nenhum arquivo de texto nem aparece nos registros. Se preferir não guardá-la, o app também aceita a variável de ambiente TYPESAFE_API_KEY.

  • O modelo do turno, quando o seletor de modelo está em Automático. Em vez de mandar sempre o mesmo motor, mede-se quanta capacidade o seu pedido precisa e escolhe-se entre os seus perfis conectados.
  • Skills relevantes. De todas as skills instaladas, só entram no contexto as que têm a ver com o pedido. Menos ruído para o modelo e menos tokens por turno.
  • Risco em «Aprovar por mim». Quando você revisa as ações uma a uma, o aviso distingue o que é reversível do que não é, em vez de tratar tudo igual.
  • O modelo de cada subagente do orquestrador. Um «renomeie esta variável em três arquivos» desce para o modelo mais rápido e barato da sua lista; um redesenho de arquitetura ou um bug que precisa ser perseguido entre camadas sobe para o mais capaz. Subagentes cujo arquivo .md já declara profile: ou model: não são tocados: o seu arquivo manda.
  • Intenção e domínios do pedido. Se o que você escreveu pede uma explicação ou um trabalho feito, e quais áreas ele toca (frontend, backend, dados, infraestrutura, segurança, QA, design, documentação…). É daí que sai a equipe proposta em um plano.

Quando uma decisão foi tomada pelo Typesafe, isso é dito:

Modelo escolhido pelo Typesafe: claude-haiku-4-5 (confiança 0,87)

Essa linha aparece ao lado do modelo do turno e no relatório de cada subagente do orquestrador. Nunca há decisão silenciosa: se você não vê a linha, foi o app que escolheu com as suas regras de sempre.

Muito pouco, porque as perguntas são minúsculas: um estado de algumas centenas de tokens e uma resposta de poucos.

  • Entrada: US$ 0,042 por milhão de tokens.
  • Um turno normal de chat faz uma ou duas perguntas. No ritmo de trabalho diário, o gasto do mês se mede em centavos.
  • O que ele pode economizar é da ordem de reais: não baixar de faixa as tarefas mecânicas do orquestrador e carregar skills que não vinham ao caso custa mais do que isso.

Tudo volta ao de sempre, sem aviso de erro e sem bloquear nada:

  • O modelo do turno é escolhido pelas regras do app.
  • As skills são filtradas por nome e descrição, como antes.
  • O risco é avaliado pela tabela de ferramentas.
  • Os subagentes herdam o motor do orquestrador.
  • A equipe é proposta pelo detector de palavras-chave.

O mesmo acontece se a resposta chegar com pouca confiança, se o serviço demorar demais ou se não houver internet. O trabalho nunca para esperando uma decisão.

  • Funciona melhor em inglês. O serviço é treinado com instruções em inglês, e é assim que o app as envia. Os seus pedidos vão exatamente como você os escreveu: em português e espanhol ele acerta, mas com um pouco menos de confiança — e menos confiança significa, simplesmente, que se usa a heurística de sempre.
  • Ele lê, não calcula. Decide sobre o texto que recebe; não executa nada, não vê os seus arquivos e não recebe o histórico do chat. Só o pedido recortado, o nome da ferramenta ou a lista de skills, conforme o caso.
  • Decisões de alto risco continuam pedindo confirmação. O Typesafe pode organizar a informação e marcar o que é delicado, mas nunca aprova por você: apagar arquivos, enviar para um remoto ou rodar comandos fora do projeto são confirmados igual a como seriam sem chave.
  • Uma sugestão não pode derrubar uma tarefa. Se o perfil proposto já não existe ou não responde, herda-se o motor anterior e o trabalho segue.