Pular para o conteúdo

Uso de tokens e modo Auto

O painel Uso de tokens mostra seu consumo real, medido localmente, e se atualiza sozinho ao fechar cada turno de chat. Tem três âmbitos:

  • Projeto atual — quanto o projeto aberto consumiu: tokens de hoje, da semana e do mês, e a série dos últimos 7 dias.
  • Global — o consumo de todo o aplicativo, com o “top” de projetos que mais gastam.
  • Provedores — cotas e limites informados por cada provedor (Claude, OpenAI, Z.AI, MiniMax…). Só mostra números entregues pelo provedor: se um plano não tem API pública de cotas, o painel diz isso com clareza em vez de inventar uma estimativa.
Uso de tokens: hoje, semana, mês e últimos 7 dias, por projeto e global.

O modo Auto mantém o trabalho andando quando um motor falha ou se esgota: se o provedor preferido de um agente não está disponível — por contexto cheio, tokens esgotados, cota, autenticação caída ou saturação —, o app passa para o próximo perfil da sua lista sem parar a tarefa.

  • Ative com o interruptor Auto e ordene os perfis arrastando-os: essa é a ordem de fallback que o orquestrador e seus subagentes vão usar.
  • Cada agente tenta primeiro o seu provedor configurado; o fallback só entra quando esse falha.
  • O botão “Ordem padrão” restaura a lista original.
O detalhamento por provedor diz de onde saiu cada token gasto.
O monitor do sistema vigia CPU, RAM, GPU, discos e rede enquanto os modelos locais trabalham.