
Coding Agent Harness: Planen Sie mit Frontier-Modellen, führen Sie in 90% weniger Zeit aus
Beschreibung
Jeder ernsthafte Coding-Agent - Claude Code, OpenCode, Codex, Cline folgt demselben Muster: ein Modell plant, ein anderes Modell führt aus. Begleiten Sie Varun Krishna, Senior Principal Solutions Engineer bei SambaNova Systems, bei den Coding-Agenten. Varun hat agentische Workflows, Modellbereitstellungssoftware und LLM-Bewertungstools bei SambaNova entwickelt und verfügt über Erfahrung in der Bereitstellung von KI/ML in den Bereichen CRM, E-Commerce, Gesundheitswesen, Finanzen und mehr bei C3.ai. Diese Sitzung zeigt Ihnen genau, wie Sie die Trennung von Planung und Ausführung aufbauen, Ihre Token-Kosten um bis zu 90% senken und vor Ende der Sitzung mit Ihrem eigenen Coding-Agenten-Harness, das auf SambaNova ausgerichtet ist, nach Hause gehen. Was Sie Lernen Werden 🔹 Wie die Trennung von Planung und Ausführung bei den heutigen führenden Coding-Agenten funktioniert 🔹 Warum das Auslagern der Ausführung an eine schnelle, speziell entwickelte Inferenzplattform die Wirtschaftlichkeit des Arbeitens mit KI verändert 🔹 Wie Modelle die Ausführungsebene in einem echten Coding-Agenten-Harness handhaben 🔹 Wie die Übergabe zwischen Planung und Ausführung strukturiert ist, Schritt für Schritt 🔹 Wie Sie Ihren eigenen Coding-Agenten in wenigen Minuten auf eine schnelle Inferenzplattform ausrichten können Warum Das Wichtig Ist Die meisten Teams, die mit Coding-Agenten arbeiten, zahlen entweder zu viel oder erbringen eine schwache Leistung. Die Verwendung eines Frontier-Modells für jeden Schritt ist teuer und langsam; die Verwendung eines schwachen Modells für alles opfert die Qualitätsweise, die Agenten nützlich macht. Das Muster des Coding-Agenten-Harness löst dies, indem die Modellkapazität mit dem Aufgabentyp abgestimmt wird – Frontier-Modelle für Planung und Urteil, schnelle, kostengünstige Modelle für die arbeitsintensive Ausführungsarbeit, die den Token-Verbrauch dominiert. Während Coding-Agenten von experimentellen Werkzeugen in tägliche Workflows übergehen, ist dies einer der direktesten Wege, um Kosten zu senken, ohne die Ausgabequalität zu berühren. Wer Sollte Kommen? Entwickler, die Coding-Agenten in ihre Workflows integrieren, KI-Ingenieure, die kosteneffiziente Inferenzstrategien erkunden, und technische Leiter, die Infrastrukturentscheidungen treffen und die Modellausgaben bewerten. Es sind keine vorherigen Plattformkenntnisse erforderlich. Bringen Sie Ihre Fragen mit – wir werden Zeit für eine Live-Q&A einplanen.
Tools, die bei der Veranstaltung verwendet werden
Claude
Lassen Sie Ihr Netzwerk wissen, dass Sie dabei sind
Teilen Sie diese Veranstaltung, um Gespräche zu beginnen, Kollegen einzuladen und sich vorab zu vernetzen.
