Le blog d'Origin Labs
Ce que nous apprenons en mettant l'IA en production : méthodes, comparatifs, workflows, benchmarks et actualité des modèles.
Actus IA
Claude Opus 5 : les benchmarks l'adorent, une partie des développeurs beaucoup moins
Claude Opus 5 bat les records des benchmarks agentiques, pourtant les développeurs reviennent à Opus 4.8. Chiffres attribués, causes et rumeurs Sonnet 5.5.
Modèles
Hallucinations des LLM : pourquoi elles sont structurelles, comment elles sont mesurées, et l'architecture qui les rend exploitables en production
Pourquoi les LLM inventent avec aplomb, ce que mesurent les classements d'hallucination, et l'architecture qui rend un modèle exploitable en production.
Actus IA
OpenAI « Doug » : ce que vaut vraiment la rumeur du plus gros modèle de fin 2026
« Doug », le nom de code prêté au prochain modèle d'OpenAI : ce qui est vérifiable, ce qui ne l'est pas, et comment réagir en production.
Guides
Vibe coding : les 5 fondamentaux pour faire coder l'IA sans perdre le contrôle
Vibe coding : les cinq principes pour faire construire une application par l'IA sans en perdre le contrôle. PRD, Git, débogage, contexte.
Modèles
Astra sous le capot : comment le prochain modèle d'OpenAI a produit dix preuves ouvertes, et ce que ça prouve vraiment
Analyse des dix preuves d'Astra (OpenAI) : certificats Lean 4 vérifiables, 2 000 $ de tokens, réactions des mathématiciens et limites honnêtes.
Benchmarks
Harvey LAB-AA sous le capot : pourquoi Kimi K3 y bat Claude Fable 5, et comment reproduire ce benchmark chez vous
Pourquoi Kimi K3 boucle 26,7 % des 120 missions juridiques de Harvey LAB-AA contre 14,2 % pour Fable 5, et la méthode pour bâtir votre propre benchmark.
Workflows
Anatomie d'un agent en production : ce que le schéma ne montre pas
Boucle, outils, garde-fous, reprises et coûts : ce qu'un agent IA devient une fois en production, par un studio qui en exploite au quotidien.
Actus IA
La vague de l'été 2026 : ce que les nouveaux modèles changent pour une PME
Fable 5, GPT-5.6, Kimi K3, Qwen 3.8 Max : la vague de modèles de l'été 2026, les prix divisés et les trois questions qu'un dirigeant de PME doit se poser.
Méthodes
Choisir le modèle d'IA de chaque workflow : notre méthode
Cinq critères pour affecter le bon modèle d'IA à chaque workflow : tâche, données, latence et coût, outillage, gouvernance. La méthode d'un studio qui livre.