HeadlinesBriefing favicon HeadlinesBriefing.com

litelm : Routage LLM minimal en 2 900 lignes

Hacker News •
×

Le routage + la traduction de litellm en ~2 900 lignes et 2 dépendances (openai, httpx). litellm route les appels LLM entre les fournisseurs et traduit entre les formats de messages. Ce cœur est enfoui sous plus de 100k LOC de serveurs proxy, couches de cache, suivi des coûts et des dizaines de fonctionnalités que la plupart des utilisateurs ne touchent jamais.

litelm extrait uniquement le chemin d'appel — routage de modèles, traduction de messages, streaming, utilisation d'outils, embeddings — et rien d'autre. Pas de classe Router, pas de proxy, pas de cache. Installation : pip install litelm # openai + httpx ; pip install litelm[anthropic] # + anthropic SDK ; pip install litelm[bedrock] # + boto3 ; pip install litelm[all] # tout.

Utilisation : import litelm; response = litelm.completion("openai/gpt-4o", messages=[{"role": "user", "content": "Hello!"}]). Chaque fonction a une variante asynchrone : acompletion, aembedding, aresponses, atext_completion. L'API reflète litellm — mêmes noms de fonctions, mêmes arguments, mêmes types de réponse. Le changement se fait par s/litellm/litelm/ dans vos imports.

Ce qui est inclus : Routage de modèles, traduction de messages (Anthropic, Bedrock, Cloudflare, Mistral), streaming + stream_chunk_builder, utilisation d'outils, embeddings, complétions de texte, OpenAI Responses API, réponses simulées. Ce qui est exclu : Router (équilibrage de charge, fallbacks), serveur proxy, cache/budget/suivi des coûts, comptage de tokens, génération d'images, audio, OCR, fine-tuning, agents, guardrails, planificateur. Route vers 19 fournisseurs via la syntaxe "provider/model-name". Tout endpoint compatible OpenAI fonctionne via api_base. Toutes les erreurs des fournisseurs sont mappées vers la hiérarchie d'exceptions de litelm. litelm est un logiciel dirigé par l'humain et assisté par IA.

Entités clés : Entreprises : litellm, litelm, OpenAI, Anthropic, Groq, Mistral, xAI, OpenRouter, Azure, Bedrock, Cloudflare, Together, Fireworks, DeepSeek, Perplexity, DeepInfra, Gemini, Cohere, Ollama, NovLLM, LM Studio, vLLM | Lieux : Paris

FAQ : Qu'est-ce que litelm ?

litelm est une extraction légère de la fonctionnalité essentielle de routage et de traduction de litellm, composée d'environ 2 900 lignes de code et de 2 dépendances (openai, httpx). Il fournit le routage de modèles, la traduction de messages, le streaming, l'utilisation d'outils et les embeddings sans le serveur proxy, le cache, le suivi des coûts ou d'autres fonctionnalités présentes dans litellm.

Question FAQ : Qu'est-ce que litelm ?

Réponse FAQ : litelm est une extraction légère de la fonctionnalité essentielle de routage et de traduction de litellm, composée d'environ 2 900 lignes de code et de 2 dépendances (openai, httpx). Il fournit le routage de modèles, la traduction de messages, le streaming, l'utilisation d'outils et les embeddings sans le serveur proxy, le cache, le suivi des coûts ou d'autres fonctionnalités présentes dans litellm.