
Harness do Agente de Codificação: Planeje com Modelos de Fronteira, Execute em 90% Menos Tempo
Descrição
Todo agente de codificação sério - Claude Code, OpenCode, Codex, Cline segue o mesmo padrão: um modelo planeja, outro modelo executa. Junte-se a Varun Krishna, Engenheiro de Soluções Principal da SambaNova Systems, sobre agentes de codificação. Varun construiu fluxos de trabalho agenticos, software de implantação de modelos e ferramentas de avaliação de LLM na SambaNova, com experiência anterior na implantação de IA/ML em CRM, e-commerce, saúde, finanças e mais na C3.ai. Esta sessão mostra exatamente como construir a separação entre planejamento/executor, reduzir seus custos de token em até 90% e sair com sua própria harness de agente de codificação apontada para a SambaNova antes do término da sessão. O que você aprenderá 🔹 Como a separação entre planejamento e execução funciona entre os principais agentes de codificação de hoje 🔹 Por que descarregar a execução para uma plataforma de inferência rápida e construída para um propósito muda a economia de construção com IA 🔹 Como os modelos lidam com a camada de execução em uma verdadeira harness de agente de codificação 🔹 Como a transferência entre planejamento e execução é estruturada, passo a passo 🔹 Como apontar seu próprio agente de codificação para uma plataforma de inferência rápida em minutos Por que isso é importante A maioria das equipes que trabalham com agentes de codificação está pagando demais ou apresentando baixo desempenho. Usar um modelo de fronteira para cada etapa é caro e lento; usar um modelo fraco para tudo sacrifica a qualidade do raciocínio que torna os agentes úteis. O padrão de harness de agente de codificação resolve isso ao combinar a capacidade do modelo com o tipo de tarefa — modelos de fronteira para planejamento e julgamento, modelos rápidos e de baixo custo para o trabalho de execução em alta volume que domina o uso de tokens. À medida que os agentes de codificação passam de ferramentas experimentais para fluxos de trabalho diários, esta é uma das maneiras mais diretas de cortar custos sem afetar a qualidade da saída. Quem deve participar? Desenvolvedores integrando agentes de codificação em seus fluxos de trabalho, engenheiros de IA explorando estratégias de inferência eficientes em termos de custo, e líderes técnicos tomando decisões de infraestrutura e avaliando gastos com modelos. Nenhuma experiência prévia na plataforma é necessária. Traga suas perguntas — reservaremos tempo para perguntas e respostas ao vivo.
Ferramentas que serão usadas nos eventos
Claude
Diga à sua rede que vai participar
Partilhe este evento para iniciar conversas, convidar colegas e conectar-se antes que comece.
