HeadlinesBriefing favicon HeadlinesBriefing.com

Mercury 2.5: schnellere und günstigere KI

Hacker News •
×

Mercury 2.5 ist das neueste KI-Modell von Inception und bietet eine deutliche Qualitätsverbesserung gegenüber Mercury 2, während es das gleiche Profil mit geringer Latenz und geringen Kosten beibehält. Es ist jetzt das größte Diffusions-Sprachmodell auf dem Markt, mit einer Steigerung der Intelligenz um 40% und Geschwindigkeiten von 1.107 Token pro Sekunde auf NVIDIA-GPUs. Das Modell unterstützt ein Kontextfenster von 260K und ist für 0,20 $ pro Million Eingabe-Token und 0,75 $ pro Million Ausgabe-Token erhältlich, mit einem Einführungsrabatt von 80%.

Reale Bereitstellungen zeigen dramatische Verbesserungen. Open Call, ein Unternehmen für Sprach-KI, reduzierte die Antwortlatenz von mehreren Minuten auf nur eine Sekunde (P99), während Augment Code die Latenz um 82% und die Kosten um 90% für Codierungsagenten senkte. Diese Ergebnisse unterstreichen die Fähigkeit von Mercury 2.5, komplexe, mehrstufige Aufgaben effizient zu bewältigen.

Zusätzlich zum Modell stellt Inception Mercury Voice und Mercury Router vor. Mercury Voice optimiert die Zeit bis zum ersten Token unter 170 ms, ideal für Sprachagenten. Mercury Router leitet Eingabeaufforderungen intelligent an das beste Modell basierend auf Qualität, Geschwindigkeit und Kosten weiter und gewährleistet so optimale Leistung für jede Arbeitslast.

Mercury 2.5 ist jetzt über die Inception API, Baseten und Open Router verfügbar. Für Unternehmen bietet Inception dedizierte Bereitstellungen, automatische Skalierung und Compliance-Kontrollen. Mit seiner Kombination aus Geschwindigkeit, Intelligenz und Erschwinglichkeit ist Mercury 2.5 bereit, die nächste Generation von KI-Anwendungen anzutreiben.

Wichtige Entitäten: Unternehmen: Inception, Open Call, Augment Code, NVIDIA | Personen: Oliver Silverstein