HeadlinesBriefing favicon HeadlinesBriefing.com

Mercury 2.5: IA más rápida y barata

Hacker News •
×

Mercury 2.5 es el último modelo de IA de Inception, que ofrece una mejora significativa de calidad sobre Mercury 2 mientras mantiene el mismo perfil de baja latencia y bajo costo. Ahora es el modelo de lenguaje de difusión más grande del mercado, con un aumento del 40% en inteligencia y velocidades de 1.107 tokens por segundo en GPU NVIDIA. El modelo admite una ventana de contexto de 260K y tiene un precio de $0,20 por millón de tokens de entrada y $0,75 por millón de tokens de salida, con un descuento de lanzamiento del 80%.

Los despliegues en el mundo real muestran mejoras dramáticas. Open Call, una empresa de IA de voz, redujo la latencia de respuesta de varios minutos a solo un segundo (P99), mientras que Augment Code redujo la latencia en un 82% y los costos en un 90% para agentes de codificación. Estos resultados destacan la capacidad de Mercury 2.5 para manejar tareas complejas de múltiples pasos de manera eficiente.

Además del modelo, Inception está presentando Mercury Voice y Mercury Router. Mercury Voice optimiza el tiempo hasta el primer token por debajo de 170 ms, ideal para agentes de voz. Mercury Router dirige inteligentemente las indicaciones al mejor modelo según calidad, velocidad y costo, asegurando un rendimiento óptimo para cualquier carga de trabajo.

Mercury 2.5 está disponible ahora a través de la API de Inception, Baseten y Open Router. Para empresas, Inception ofrece despliegues dedicados, autoescalado y controles de cumplimiento. Con su combinación de velocidad, inteligencia y asequibilidad, Mercury 2.5 está listo para impulsar la próxima generación de aplicaciones de IA.

Entidades clave: Empresas: Inception, Open Call, Augment Code, NVIDIA | Personas: Oliver Silverstein