IAT Search passe à Claude Opus 5.5 : une lecture juridique plus fine, des citations mieux vérifiées
Nous sommes ravis d'annoncer que, depuis le 23 septembre 2026, toutes les analyses d'International AT Search reposent sur Claude Opus 5.5, le plus récent des modèles Opus d'Anthropic, qui remplace Claude Opus 4.8. Questions de recherche, comparaisons entre tribunaux, questions de suivi et vérification des citations passent au nouveau moteur, sans aucun changement de votre abonnement ni de votre quota.
Ce choix ne repose pas sur un classement général. Nous l'avons fait après avoir soumis les deux moteurs au type de questions que nos utilisateurs traitent sur la plateforme, et confronté leurs réponses aux jugements eux-mêmes.
Notre protocole
Nous avons soumis dix questions de recherche aux deux moteurs, devant cinq juridictions : le Tribunal administratif de l'OIT (TAOIT), le Tribunal d'appel des Nations Unies, le Tribunal du contentieux administratif des Nations Unies, le Tribunal administratif de la Banque mondiale et le Tribunal administratif du FMI. Elles couvrent des degrés variables de consolidation jurisprudentielle : des lignes bien établies, comme le droit d'être entendu avant une mesure disciplinaire ou le traitement des témoignages par ouï-dire ; des lignes en formation, comme la qualité pour agir d'un ancien fonctionnaire contre le traitement d'une plainte pour harcèlement ; et des questions de procédure plus étroites, sur lesquelles la jurisprudence est rare ou incertaine, des pièces produites après la réplique à la recevabilité des appels incidents.
Pour chaque question, les deux moteurs ont reçu les mêmes jugements et les mêmes instructions : le modèle était la seule variable. Chaque note a ensuite fait l'objet de contrôles automatiques, chaque citation textuelle étant confrontée aux textes sources et chaque montant des tableaux de résultats au dispositif du jugement. Six des dix notes ont été soumises à une évaluation à l'aveugle : anonymisées et mélangées, elles ont été examinées par un modèle distinct et plus puissant (Claude Fable 5.1), qui en a vérifié les affirmations une à une au regard du texte intégral des jugements de notre base, soit près de 400 affirmations pour les deux moteurs. Nous avons nous-mêmes contrôlé ses conclusions par sondage.
Ce qui change
| Opus 5.5 par rapport à Opus 4.8 | |
|---|---|
| Préféré lors de l'évaluation à l'aveugle | 6 comparaisons sur 6 |
| Mieux noté pour l'exactitude, l'exhaustivité et l'utilité pratique | 6 comparaisons sur 6 |
| Citations textuelles des jugements et des textes normatifs | environ deux fois plus nombreuses |
| Citations retrouvées dans les textes sources dès la première vérification | 97 % |
Les deux moteurs ont rapporté exactement les solutions et les montants alloués, et n'ont cité que des autorités figurant dans les pièces qui leur étaient soumises. Opus 5.5 fait la différence sur les points les plus fins de la lecture juridique : distinguer la position du Tribunal des moyens des parties ou de l'avis d'un organe de recours interne, replacer chaque précédent dans son cadre procédural exact, et faire ressortir l'autorité contraire à la thèse examinée, pour que le praticien puisse s'y préparer.
En pratique : l'appel incident devant le Tribunal d'appel des Nations Unies. Interrogé sur les cas où le Tribunal d'appel déclare un appel incident irrecevable, Opus 5.5 a replacé chaque précédent dans son cadre procédural exact (Wu, 2013-UNAT-306, par exemple, comme autorité sur l'appel incident de la partie contre laquelle un jugement par défaut avait été rendu), exposé les précédents défavorables dans les deux sens et signalé la tension, non résolue, entre Bagot (2017-UNAT-718) et la jurisprudence ultérieure. L'évaluateur a vérifié 36 de ses affirmations au regard des jugements et les a toutes confirmées.
Une vérification des citations plus exigeante
La fonction Verify, qui confronte une citation d'une analyse au jugement cité, repose elle aussi sur Opus 5.5, et elle se montre plus exigeante. Sur un test portant sur quatorze citations, ses verdicts ont rejoint ceux du vérificateur précédent dans onze cas ; dans les trois autres, il a opéré des distinctions plus fines, en relevant des exagérations dans la manière dont un jugement était présenté et en limitant son appréciation au jugement effectivement cité.
En pratique : le jugement 4502. Une analyse citait cette affaire de classement de poste à l'UNESCO à l'appui de l'idée qu'un organe de recours interne dépourvu d'expertise technique se borne à contrôler la procédure. Le nouveau vérificateur n'a jugé la citation que partiellement exacte, en expliquant pourquoi, et le jugement lui donne raison : le Conseil d'appel avait décliné sa compétence en raison du départ à la retraite de la requérante, il avait en réalité critiqué le fond de l'audit de classement, et le Tribunal a écarté cette critique au vu des pièces du dossier, et non pour défaut de compétence.
La vérification est aussi plus rapide, 14 secondes par citation au lieu de 18, et chaque vérification aboutit à un verdict explicite : lorsque le vérificateur ne parvient pas à conclure, la citation est clairement signalée comme non vérifiée.
Sous le capot : une recherche hybride, désormais enrichie d'un graphe des citations
Un meilleur modèle ne raisonne que sur ce qu'on lui soumet ; c'est pourquoi la migration s'accompagne d'une nouvelle couche dans notre manière de rechercher la jurisprudence. La recherche sur IAT Search est hybride. Une recherche sémantique porte sur le texte intégral de chaque jugement, une recherche lexicale retrouve les termes consacrés, et un module de reclassement par IA retient les jugements qui traitent réellement de votre question plutôt que ceux qui ne font que la mentionner ; le modèle travaille ensuite sur le texte intégral des jugements retenus, et non sur des extraits. La nouvelle couche est un graphe des citations : les précédents les plus cités par les jugements retenus rejoignent désormais l'analyse, car les décisions qui fondent une ligne jurisprudentielle sont souvent celles que les jugements ultérieurs ne cessent de citer, qu'elles emploient ou non les termes de votre question. Sur les témoignages par ouï-dire, par exemple, le graphe fait entrer le jugement 203 (1973) et le jugement 999 (1990), décisions fondatrices en matière de garanties procédurales qui ne mentionnent jamais l'ouï-dire et que la recherche elle-même n'avait pas fait remonter. Le graphe des citations est en service pour le TAOIT, et nous l'étendons aux autres tribunaux.
À quoi vous attendre
Les analyses sont plus complètes, environ 60 % plus longues en moyenne, et demandent un peu plus de temps, généralement autour de trois minutes. Chaque citation textuelle reste confrontée aux textes sources, toute citation introuvable vous étant signalée, et chaque jugement cité s'ouvre en un clic sur son texte intégral. Essayez-le dès aujourd'hui sur la question qui vous occupe.