📚 Tous les articles
200 guide(s) — mis à jour régulièrement
MiniMax M3.1 Flash Preview : la Chine continue sa guerre des petits modèles rapides
Découvrez MiniMax M3.1 Flash Preview, le nouveau petit modèle rapide chinois lancé discrètement le 27 septembre 2026, sans model card ni communiqué.
Hindsight : la mémoire des agents IA devient un produit à part entière (+1 653 stars en un jour)
Hindsight, la couche mémoire open source pour agents IA, cartonne sur GitHub avec +1 653 étoiles en un jour. La mémoire des agents IA devient un produit.
Laya : le « modèle de décision » open-source de 421M params qui veut remplacer le LLM dans vos agents
Laya, le modèle de décision open-source de 421M params qui veut remplacer le LLM pour router, scorer et valider les décisions de vos agents IA.
ElevenLabs Eleven v4 : la génération vocale passe un cran avec Turbo et la latence temps réel
ElevenLabs Eleven v4 : génération vocale de qualité studio et latence temps réel avec Turbo. La nouvelle référence pour agents conversationnels IA.
Claude Sonnet 5.5 : Anthropic attaque le mid-market avec 30 % plus rapide et 30 % moins cher
Claude Sonnet 5.5 : Anthropic cible le mid-market avec un modèle 30 % plus rapide et 30 % moins cher. Analyse du nouveau modèle de la famille Claude 5.5.
« Do not guess » : une seule phrase réduit les champs hallucinés de 71 % à 20 % sur 16 modèles frontier
Découvrez comment la phrase « Do not guess » réduit les champs hallucinés des LLM de 71 % à 20 % sur 16 modèles frontier. Une astuce simple pour vos pipelines.
Les modèles ouverts tournent déjà 56 % des tokens de Vercel : la migration silencieuse des entreprises hors d'OpenAI et Anthropic
Les modèles ouverts exécutent 56 % des tokens de Vercel : découvrez comment les entreprises migrent silencieusement hors d'OpenAI et Anthropic vers l'open sourc
Naive-N0.5-Flash : le MoE open-weight de 309B sans aucune couche full-attention vise 2 000 tokens/s par utilisateur
Naive-N0.5-Flash : le MoE open-weight de 309B paramètres sans full-attention dévoilé par NaiveAI vise 2 000 tokens/s par utilisateur sur Hugging Face.
Claude bat le record de calcul en physique théorique : l'amplitude de Yang-Mills à 9 boucles pour 2 000 $ de compute
Claude bat un record de physique théorique : l'amplitude de Yang-Mills à 9 boucles calculée pour 2 000 $ de compute. Un défi IA historique.
NVIDIA Open Agent Safety Platform : OpenShell et Sentry veulent enfermer les agents IA avant qu'ils ne s'échappent
NVIDIA Open Agent Safety Platform : OpenShell et Sentry pour enfermer les agents IA et prévenir leur échappement. Décryptage de cette nouvelle solution.
Gemini 3.8 Live avec Live Avatar : Google ajoute une présence visuelle temps réel à son assistant conversationnel
Google annonce Gemini 3.8 Live avec Live Avatar : un assistant conversationnel doté d'une présence visuelle temps réel qui écoute, voit et parle.
Chine-USA : première ligne rouge IA au monde — Pékin et Washington ouvrent un canal de communication dédié aux incidents IA
Chine-USA : la première ligne rouge IA au monde. Pékin et Washington ouvrent un canal de communication dédié aux incidents d'intelligence artificielle.