
Künstliche Analyse: Inferenz, Gemessen
Description
Die Inferenz ist der entscheidende Schritt, der die Geschwindigkeit, die Kosten und die Qualität jeder Anfrage prägt, die Ihre Anwendung stellt. Mit neuen Modellen, die wöchentlich veröffentlicht werden, verändert sich die Infrastrukturlandschaft ebenso schnell wie die Modelle selbst.Die Auswahl eines Inferenzanbieters hat viele Überlegungen, einschließlich Geschwindigkeit, Kosten (einschließlich Rabatte für Cache-Preise), Latenz und Unterstützung am ersten Tag für neue Modelle.Die Künstliche Analyse bewertet über 500 Inferenz-Endpunkte hinsichtlich Geschwindigkeit, Kosten, Latenz und Qualität. Unsere Bewertungen zeigen, dass die Ausgabegeschwindigkeiten für dasselbe Modell zwischen den Anbietern um das 15-fache variieren können. Für dieselbe Anfrage kann die End-to-End-Antwortzeit um bis zu 12× variieren, während der Kostenunterschied zwischen dem günstigsten und dem teuersten Anbieter mehr als das 3-fache überschreiten kann.Treten Sie dem Team der Künstlichen Analyse bei für einen Abend mit Führungspersönlichkeiten aus der AI-Inferenz. Wir werden die wichtigsten Inferenztrends untersuchen, aufschlüsseln, was die Benchmarkdaten enthüllen, und diskutieren, was diese Unterschiede für die Entwickler im Bereich AI bedeuten.Agenda:Referenten:Bald bekannt gegeben…👀Fotografische und videografische Hinweise: Mit der Teilnahme an dieser Veranstaltung erkennen Sie an, dass Fotografien und Videos aufgenommen werden können. Wenn Sie nicht einverstanden sind, wenden Sie sich bitte an den Veranstalter.
Event location
Let your network know you're going
Share this event to start conversations, invite colleagues, and connect before it begins.