HeadlinesBriefing favicon HeadlinesBriefing.com

Mercury 2.5: AI Lebih Cepat dan Murah

Hacker News •
×

Mercury 2.5 adalah model AI terbaru dari Inception, yang menawarkan peningkatan kualitas signifikan dibandingkan Mercury 2 sambil mempertahankan profil latensi rendah dan biaya rendah yang sama. Sekarang ini adalah model bahasa difusi terbesar di pasar, dengan peningkatan kecerdasan 40% dan kecepatan 1.107 token per detik pada GPU NVIDIA. Model ini mendukung jendela konteks 260K dan dibanderol $0,20 per juta token masukan dan $0,75 per juta token keluaran, dengan diskon peluncuran 80%.

Penerapan di dunia nyata menunjukkan peningkatan dramatis. Open Call, perusahaan AI suara, mengurangi latensi respons dari beberapa menit menjadi hanya satu detik (P99), sementara Augment Code mengurangi latensi sebesar 82% dan biaya sebesar 90% untuk agen pengkodean. Hasil ini menyoroti kemampuan Mercury 2.5 untuk menangani tugas kompleks multi-langkah secara efisien.

Selain model, Inception sedang mempratinjau Mercury Voice dan Mercury Router. Mercury Voice mengoptimalkan waktu ke token pertama di bawah 170ms, ideal untuk agen suara. Mercury Router secara cerdas mengarahkan prompt ke model terbaik berdasarkan kualitas, kecepatan, dan biaya, memastikan kinerja optimal untuk beban kerja apa pun.

Mercury 2.5 tersedia sekarang melalui Inception API, Baseten, dan Open Router. Untuk perusahaan, Inception menawarkan penerapan khusus, penskalaan otomatis, dan kontrol kepatuhan. Dengan kombinasi kecepatan, kecerdasan, dan keterjangkauan, Mercury 2.5 siap mendukung generasi berikutnya dari aplikasi AI.

Entitas Kunci: Perusahaan: Inception, Open Call, Augment Code, NVIDIA | Orang: Oliver Silverstein