Ir para o conteúdo
Thales Gomes

Blog sobre inteligência artificial, programação com IA, Claude Code, Codex e Agentes de IA

Tag: LLM em produção

Custo de tokens em IA: como reduzir gastos em produção

Painel com gráfico de custos, tokens estilizados fluindo, cofrinho e setas de roteamento nas cores #1283C4 e #0D0D0D.

Custo de tokens em produção sobe rápido sem controle. Veja como monitorar, cachear e rotear modelos para reduzir o gasto sem perder qualidade.

Tool use em agentes de IA: como projetar ferramentas que o modelo realmente consegue usar

Diagrama de tool use em agentes de IA mostrando fluxo de chamada de ferramenta com parametros e retorno estruturado em interface de agente

Tool use em agentes de IA falha com mais frequência por problema de design do que por limitação do modelo. Entenda o que faz uma ferramenta funcionar de verdade em produção.

Thales Gomes

Blog sobre inteligência artificial, programação com IA, Claude Code, Codex e Agentes de IA

All rights reserved