Le blog d'Origin Labs

Ce que nous apprenons en mettant l'IA en production : méthodes, comparatifs, workflows, benchmarks et actualité des modèles.

Actus IA

Claude Opus 5 : les benchmarks l'adorent, une partie des développeurs beaucoup moins

Claude Opus 5 bat les records des benchmarks agentiques, pourtant les développeurs reviennent à Opus 4.8. Chiffres attribués, causes et rumeurs Sonnet 5.5.

Modèles

Hallucinations des LLM : pourquoi elles sont structurelles, comment elles sont mesurées, et l'architecture qui les rend exploitables en production

Pourquoi les LLM inventent avec aplomb, ce que mesurent les classements d'hallucination, et l'architecture qui rend un modèle exploitable en production.

Actus IA

OpenAI « Doug » : ce que vaut vraiment la rumeur du plus gros modèle de fin 2026

« Doug », le nom de code prêté au prochain modèle d'OpenAI : ce qui est vérifiable, ce qui ne l'est pas, et comment réagir en production.

Guides

Vibe coding : les 5 fondamentaux pour faire coder l'IA sans perdre le contrôle

Vibe coding : les cinq principes pour faire construire une application par l'IA sans en perdre le contrôle. PRD, Git, débogage, contexte.

Modèles

Astra sous le capot : comment le prochain modèle d'OpenAI a produit dix preuves ouvertes, et ce que ça prouve vraiment

Analyse des dix preuves d'Astra (OpenAI) : certificats Lean 4 vérifiables, 2 000 $ de tokens, réactions des mathématiciens et limites honnêtes.

Benchmarks

Harvey LAB-AA sous le capot : pourquoi Kimi K3 y bat Claude Fable 5, et comment reproduire ce benchmark chez vous

Pourquoi Kimi K3 boucle 26,7 % des 120 missions juridiques de Harvey LAB-AA contre 14,2 % pour Fable 5, et la méthode pour bâtir votre propre benchmark.

Workflows

Anatomie d'un agent en production : ce que le schéma ne montre pas

Boucle, outils, garde-fous, reprises et coûts : ce qu'un agent IA devient une fois en production, par un studio qui en exploite au quotidien.

Actus IA

La vague de l'été 2026 : ce que les nouveaux modèles changent pour une PME

Fable 5, GPT-5.6, Kimi K3, Qwen 3.8 Max : la vague de modèles de l'été 2026, les prix divisés et les trois questions qu'un dirigeant de PME doit se poser.

Méthodes

Choisir le modèle d'IA de chaque workflow : notre méthode

Cinq critères pour affecter le bon modèle d'IA à chaque workflow : tâche, données, latence et coût, outillage, gouvernance. La méthode d'un studio qui livre.