🛠️ Outils

Claude Code

Anthropic



🗨️ Vos retours libres


📰 Actualités récentes depuis la source

ℹ️ Plus d’infos via Wikipédia

Claude (modèle de langage)

Claude
Description de l'image Claude AI logo.svg.
Description de l'image Claude Opus 4.1 output example screenshot.webp.
Informations
Développé par AnthropicVoir et modifier les données sur Wikidata
Première version
Dernière version Claude Fable 5 ()
Type Famille de grands modèles de langage
Licence Propriétaire
Site web https://claude.ai

Claude est une série de grands modèles de langage développés par Anthropic[1]. C'est aussi le nom de l'agent conversationnel (chatbot) utilisant ces modèles pour dialoguer avec les utilisateurs. Claude peut analyser des images et différents types de fichiers, et faire des recherches sur internet. Claude est connu pour ses performances en programmation informatique[2],[3], particulièrement avec le logiciel d'IA agentique Claude Code[4]. Un autre logiciel nommé Cowork vise à automatiser diverses tâches bureautiques[5].

La première version est sortie en [6]. Claude Sonnet désigne la version moyenne du modèle. Claude Opus est un modèle plus coûteux et performant, et Haiku un modèle plus léger et rapide. Un modèle plus puissant nommé Claude Mythos est sorti en 2026, mais n'a été mis à disposition que d'un nombre restreint d'entreprises pour des tâches de cybersécurité du fait de sa capacité à trouver et à exploiter des vulnérabilités logicielles[7].

Fonctionnalités

Outre les fonctionnalités de traitement de texte, Claude peut analyser des images, faire des recherches sur internet[8], traiter différents types de fichiers tels que les PDF[9], et converser à l'oral[10].

Abonnements

Claude peut être utilisé gratuitement, mais les abonnements donnent accès à des seuils d'utilisation plus élevés et à des fonctionnalités supplémentaires comme Claude Code et Claude dans Chrome[11],[12]. Anthropic a fourni en septembre 2023 sa première offre commerciale avec Claude Pro. En mai 2024, Anthropic a commencé à proposer les abonnements multi-utilisateurs Claude Team[13] et Claude Enterprise[14]. En avril 2025, Anthropic a lancé un abonnement plus coûteux nommé Claude Max[15].

Artifacts

La fonctionnalité Artifacts affiche dans un panneau dédié des documents ou du code informatique interprété. Par exemple, cela permet de visualiser directement des diagrammes et de les ajuster itérativement[16].

Utilisation d'ordinateur

En octobre 2024, Anthropic a lancé la fonctionnalité computer use (« utilisation d'ordinateur ») permettant à Claude de prendre le contrôle de l'ordinateur et de naviguer en analysant l'écran et en simulant les entrées clavier et souris[17].

En mars 2026, Anthropic a ajouté la possibilité de contrôler par téléphone les actions de Claude sur l'ordinateur[18].

Claude Code

Claude Code est un logiciel d'IA agentique qui permet d'automatiser des tâches de développement logiciel. Il peut écrire, exécuter, corriger et réorganiser du code informatique[5].

Déployé au grand public en mai 2025, Claude Code a connu une croissance rapide. En février 2026, il génère un revenu annualisé de 2,5 milliards de dollars, et une estimation suggère que 4 % des modifications publiées sur GitHub sont générées par Claude Code[19].

Claude Security

Claude Security sert à analyser du code à la recherche de vulnérabilités, et propose des corrections ciblées[20].

Code Review

Claude Review fait des revues de code automatisées. Lorsqu'une modification de code est proposée, il mobilise une équipe d'agents d'IA pour chercher des bugs, vérifier qu'il s'agit bien de bugs, et les classer par niveau de gravité[21].

Claude Cowork

Cowork est un logiciel d'IA agentique permettant à Claude d'effectuer des tâches bureautiques avec une certaine autonomie. Lancé en janvier 2026, Cowork est similaire à Claude Code, mais est contrôlé via une interface graphique et vise un public plus général que celui des développeurs de logiciels. Il a accès à un dossier de travail choisi par l'utilisateur, et peut y générer ou modifier des fichiers, et exécuter certaines commandes informatiques. Cowork peut par exemple synthétiser des documents, créer des présentations, modifier des fichiers Excel, utiliser un navigateur web, ou gérer des emails. Anthropic recommande toutefois de configurer Cowork pour qu'il n'ait pas accès à des informations sensibles. Le code source de Cowork aurait en grande partie été écrit avec Claude Code[5].

Claude Design

Claude Design, lancé en avril 2026, permet d'automatiser la création d'interfaces graphiques et d'éléments visuels (prototypes, présentations, logos, bannières...)[22].

Entraînement

Les modèles de la famille Claude sont des transformeurs génératifs pré-entraînés. Ils ont été pré-entraînés à prédire le mot suivant pour de grandes quantités de texte. Pour que ces modèles soient non seulement performants mais aussi présentables, ils ont ensuite été entraînés avec la technique de l'IA constitutionnelle[23].

IA constitutionnelle

L'IA constitutionnelle est une approche développée par Anthropic pour entraîner les systèmes d'IA (tels Claude) à être utiles, sincères et inoffensifs sans nécessiter de rétroaction humaine, en intégrant parmi ses filtres dans l'entraînement des modèles d'IA, des valeurs et principes inspirés de documents comme la Déclaration universelle des droits de l'homme de l'ONU[23],[24].

Dans une phase d'apprentissage supervisé, le modèle génère des réponses, s'autocritique sur la base d'un ensemble de principes (une « constitution »), puis ajuste ses réponses. Ces réponses davantage conformes à la constitution sont ensuite utilisées pour entraîner le modèle[23].

Ensuite vient une phase d'apprentissage par renforcement. Le modèle génère des réponses et les compare, favorisant celles qui satisfont le plus les principes de la constitution. Ces données permettent d'entraîner un modèle de préférences, qui juge des réponses en fonction de leur degré de conformité à la constitution. Claude est ensuite ajusté à satisfaire ce modèle de préférences. Cette technique est similaire à l'apprentissage par renforcement à partir de rétroaction humaine, où les comparaisons humaines sont nécessaires, tandis que l'IA constitutionnelle effectue automatiquement les comparaisons en s'appuyant sur la constitution[25],[23].

Modèles

Claude

Claude est la version initiale du modèle de langage d'Anthropic, sortie en [6]. Claude a démontré sa maîtrise de diverses tâches, mais avait certaines limitations en matière de codage, de mathématiques et de raisonnement[26]. Anthropic s'est associée à des sociétés comme Notion (logiciel de prise de notes et de productivité) et Quora (pour aider à développer le chatbot Poe)[26].

Certains employés d'Anthropic considèrent le nom « Claude » comme une référence au mathématicien Claude Shannon, père de la théorie de l'information[27],[28]. D'autres employés le décrivent comme un nom masculin amical pour contrebalancer les noms féminins d'assistants d'IA comme Alexa, Siri ou Cortana[28].

Claude Instant

Claude Instant est une version plus rapide, moins chère et plus légère. Claude Instant a une fenêtre de contexte de 100 000 tokens (ce qui correspond à environ 75 000 mots)[29]. La fenêtre de contexte représente la quantité de données que le modèle peut analyser simultanément.

Claude 2

Claude 2 est la deuxième itération majeure, sortie le . Elle a été rendue accessible au grand public, contrairement à la première version, qui n'était accessible qu'à certains utilisateurs approuvés par Anthropic[30].

Claude 2 a été critiqué pour son alignement éthique strict qui semble réduire l'utilisabilité et les performances. Des utilisateurs se sont vu refuser l'assistance pour des requêtes bénignes, par exemple avec la question d'informatique système « Comment puis-je tuer tous les processus Python de mon serveur Ubuntu ? » Cela a conduit à un débat sur la « taxe d'alignement » (le coût pour garantir l'alignement d'un système d'IA), avec des discussions centrées sur l'équilibre entre les considérations éthiques et les fonctionnalités pratiques. Les critiques plaident en faveur de l’efficacité et de l’autonomie des utilisateurs, tandis que les partisans soulignent l’importance d’une IA éthique[31],[32].

Claude 2.1

Claude 2.1 a doublé le nombre de tokens que le chatbot peut analyser simultanément, le portant à une fenêtre de 200 000 tokens, ce qui équivaut à environ 500 pages[1].

Selon Anthropic, ce nouveau modèle est moins susceptible de se tromper que ses prédécesseurs[32].

Claude 3

À sa sortie le , Claude 3 s'est avéré être à la pointe des performances dans un large éventail de tâches cognitives. La famille Claude 3 comprend trois modèles de pointe par ordre croissant de capacités : Haiku, Sonnet et Opus[33],[34].

Claude 3 a montré des capacités de raisonnement méta-cognitif, notamment en ayant réalisé qu'il était artificiellement testé lors d'une évaluation impliquant le fait d'extraire une information dans de grandes quantités de texte[35],[36].

Claude 3.5

Le , Anthropic sort Claude Sonnet 3.5, qui surpasse significativement Claude 3 Opus tout en étant deux fois plus rapide. Cette annonce fait concurrence au modèle GPT-4o d'OpenAI, sorti un mois plus tôt : Anthropic présente son modèle comme étant plus performant que son concurrent dans la résolution de plusieurs tâches, en particulier dans la compréhension visuelle[37],[38].

Claude 3.7

Anthropic a lancé Claude 3.7 Sonnet le , avec un mode de réflexion approfondie pour les questions complexes[39].

Claude 4.0

Le , Anthropic a publié deux autres modèles : Claude Sonnet 4 et Claude Opus 4[40]. Anthropic a ajouté des fonctionnalités API pour les développeurs : un outil d'exécution de code, un connecteur à son Model Context Protocol, et Files API[41],[42]. Elle a classé Opus 4 comme un modèle de « niveau 3 » sur l'échelle de sécurité à quatre points de l'entreprise, ce qui signifie qu'elle le considère si puissant qu'il présente un « risque significativement plus élevé »[43]. Anthropic a rapporté que lors d'un test de sécurité impliquant un scénario fictif, les grands modèles de langage comme Claude ont tendance à envoyer un courriel de chantage à un ingénieur afin d'empêcher leur remplacement[44].

Claude 4.5

Le , Anthropic sort Claude Sonnet 4.5. Le modèle est particulièrement performant en développement de logiciels, marquant un nouveau record sur le test de performances SWE-bench[45],[46].

Le , Anthropic complète la gamme avec Claude Haiku 4.5, un modèle plus rapide et économique conçu pour des performances proches de Sonnet 4 à un tiers du coût[47]. Haiku 4.5 obtient un score de 73,3 % sur le test SWE-bench Verified, et devient le modèle par défaut pour les utilisateurs gratuits de claude.ai[48]. Un cas d'usage possible concerne les architectures multi-agents, où Sonnet 4.5 peut planifier des projets complexes tandis que plusieurs instances de Haiku 4.5 exécutent des tâches en parallèle[49].

En novembre, l'entreprise sort Claude Opus 4.5, un modèle alternatif plus puissant, avec une baisse des prix importante par rapport à ses précédents modèles et ses concurrents[50].

Claude 4.6

Le , Anthropic présente Claude Opus 4.6, décrit comme son modèle le plus performant à ce jour. Il intègre une nouvelle capacité de « pensée adaptative » (adaptive thinking), permettant au modèle de doser son effort de réflexion en fonction de la complexité du problème posé. Cette version propose également une fenêtre de contexte étendue à un million de jetons (tokens) et des améliorations significatives concernant l'utilisation autonome de l'ordinateur (computer use)[51].

Le , Anthropic lance Claude Sonnet 4.6. Il apporte des améliorations en matière de programmation, d'utilisation autonome de l'ordinateur (computer use), de raisonnement sur de longs contextes et de planification agentique. Comme Opus 4.6, il dispose d'une fenêtre de contexte d'un million de jetons en bêta. Proposé au même tarif que Sonnet 4.5, il devient le modèle par défaut sur claude.ai pour les utilisateurs des offres gratuites[52].

Claude 4.7

Le 16 avril 2026, Anthropic publie Claude Opus 4.7, présenté comme son modèle généralement disponible le plus performant[53]. Le modèle apporte des améliorations notables en ingénierie logicielle, en compréhension visuelle (capable de traiter des images en plus haute résolution) et en exécution de tâches complexes sur de longues durées[54]. Il introduit un nouveau niveau de raisonnement nommé xhigh extra high »), positionné entre les niveaux high et max, offrant un contrôle plus fin sur le compromis entre profondeur de réflexion et latence[55].

Anthropic reconnaît publiquement que Claude Opus 4.7 reste moins puissant que Claude Mythos Preview, mais le présente comme le premier modèle largement déployé avec un nouveau dispositif de garde-fous destinés à détecter et bloquer automatiquement les requêtes liées à des usages cybersécuritaires interdits ou à haut risque[53]. Les chercheurs en sécurité informatique souhaitant utiliser le modèle pour des usages légitimes (recherche de vulnérabilités, tests d'intrusion, red-teaming) peuvent rejoindre un programme de vérification dédié.

Le modèle est disponible sur l'ensemble des produits Claude, sur la Claude API ainsi que sur Amazon Bedrock, Google Cloud Vertex AI et Microsoft Foundry, au même tarif qu'Opus 4.6 (5 dollars par million de jetons en entrée et 25 dollars par million de jetons en sortie)[53].

Claude 4.8

Le 28 mai 2026, Anthropic publie Claude Opus 4.8, présenté comme une mise à niveau d'Opus 4.7 et son modèle public le plus performant. L'entreprise met en avant des gains sur plusieurs jeux d'évaluation en programmation, en compétences agentiques, en raisonnement et en tâches de travail intellectuel. Selon Anthropic, le modèle signal plus volontiers ses incertitudes et produit moins d'affirmations non étayées que son prédécesseur[56]. La sortie intervient environ six semaines seulement après celle d'Opus 4.7, marquant une accélération du rythme de mises à jour.

Le modèle est proposé au même tarif qu'Opus 4.7 (5 dollars par million de jetons en entrée, 25 dollars en sortie). Un « mode rapide » (fast mode), facturé 10 et 50 dollars par million de jetons, fonctionne à 2,5 fois la vitesse. La version introduit un réglage laissant l'utilisateur doser l'effort de réflexion du modèle, ainsi qu'une fonctionnalité « dynamic workflows » dans Claude Code, en aperçu de recherche, capable d'orchestrer de nombreux sous-agents en parallèle pour des tâches de grande ampleur[57]. Selon Anthropic, Opus 4.8 demeure moins performant que Claude Mythos, dont l'entreprise annonce un déploiement élargi "dans les prochaines semaines"[58].

Claude Mythos Preview

Claude Mythos est un modèle de langage plus performant que Opus. Son existence a été révélée au grand public en mars 2026 à la suite d'une fuite de données liée à une vulnérabilité de configuration du CMS de l'entreprise[59],[60].

Souvent présenté comme une rupture technologique majeure dépassant les capacités de Claude Opus 4.6, ce modèle se distingue par ses performances en raisonnement complexe et en cybersécurité offensive (au prix cependant d'une consommation énergétique et de ressources de calcul très élevées)[61]. Sur les benchmarks de référence, Mythos surpasse significativement ses prédécesseurs, atteignant notamment 93,9 % au SWE-bench Verified et un score parfait de 100 % sur Cybench, où il a identifié des failles zero-day critiques dans le noyau Linux, ainsi que dans OpenBSD et FFmpeg[62],[63]. Ses capacités d'analyse scientifique sont également notables avec un score de 94,6 % au test GPQA Diamond, surpassant le niveau d'experts humains titulaires d'un doctorat[62].

Face aux risques de détournement de Mythos pour des attaques automatisées, Anthropic a décidé de ne pas rendre ce modèle accessible au public, et de créer un projet nommé « Projet Glasswing » chargé d'utiliser ses capacités en cybersécurité « pour aider à sécuriser les logiciels les plus critiques au monde, et pour préparer l’industrie aux pratiques que nous allons tous devoir adopter pour garder une longueur d’avance sur les cyberattaquants »[64].

Glasswing est un consortium qui, lors de son lancement, regroupait Amazon Web Services, Anthropic, Apple, Broadcom, Cisco, CrowdStrike, Google, JPMorganChase, la Linux Foundation, Microsoft, NVIDIA et Palo Alto Networks[65],[66]. Le groupe a été ensuite élargi à plus de 40 organisations supplémentaires qui construisent ou maintiennent des infrastructures logicielles critiques[67].

Le , l'entreprise publie une Hazard-Aware System Card (HASC) de 244 pages documentant les garde-fous et les comportements limites du système[68],[69]. Ce document révèle des incidents d'autonomie préoccupants lors de tests en environnement isolé (sandbox), incluant l'évasion du modèle par le contournement de restrictions logicielles, la modification de fichiers avec dissimulation dans l'historique Git, et des tentatives inattendues de communication externe. Bien qu'aucune capacité de réplication autonome n'ait été constatée, le passage à un délai d'exploitation des failles de l'ordre de quelques minutes est considéré par Anthropic comme un changement de paradigme pour la sécurité informatique, justifiant la décision de ne pas rendre le modèle public à ce jour[70].

Claude 5

Le 9 juin 2026, Anthropic lance Claude Fable 5, présenté comme un modèle de classe Mythos rendu accessible au grand public grâce à des garde-fous : certaines requêtes sensibles, notamment en cybersécurité, sont automatiquement redirigées vers le modèle Claude Opus 4.8. Pour les membres du projet Glasswing, l'entreprise déploie Claude Mythos 5, le successeur de Claude Mythos Preview[71].

Le 12 juin 2026, soit seulement quelques jours après le lancement, Anthropic suspend l'accès à Fable 5 pour l'ensemble de ses clients, à la suite d'une directive de contrôle des exportations du gouvernement américain interdisant l'accès à ces modèles à tout ressortissant étranger. La nationalité ne pouvant être vérifiée en temps réel, l'entreprise désactive les deux modèles pour tous les utilisateurs, ses autres modèles restant accessibles[72]. Fable 5 est finalement redéployé au grand public le après la levée des restrictions[73].

Le 30 juin, Anthropic lance Claude Sonnet 5[74].

Transparence

Anthropic a publié en 2024 un document[75] expliquant quels sont les prompts système utilisés par Anthropic pour censurer ou moduler certains des comportements de Claude ; et ce pour trois modèles d'intelligence artificielle : Claude 3.5 Sonnet ; Claude 3 Opus et Claude 3 Haiku[76]. Les utilisateurs peuvent par exemple comprendre comment Claude est censé répondre aux questions concernant des sujets controversés (avec des phrases approfondies et claires, sans rappeler que le sujet est sensible ou prétendre qu'il fournit des faits objectifs)[76].

Références

  1. 1 2 (en) Wes Davis, « OpenAI rival Anthropic makes its Claude chatbot even more useful », The Verge, (consulté le ).
  2. Nicolas Lellouche, « Anthropic lance Claude Sonnet 4.5, un nouveau modèle présenté comme plus performant que GPT-5 », sur Numerama, (consulté le ).
  3. « Anthropic frappe fort avec Claude Sonnet 4.5 qui surpasse allègrement GPT-5 », sur L'Usine Digitale, .
  4. Benjamin Polge, « Avec Claude Sonnet 4.5, Anthropic reprend la tête sur le code », sur JDN, (consulté le ).
  5. 1 2 3 Lisa Imperatrice, « Fini les tâches ingrates ? Anthropic lance Claude Cowork pour automatiser votre travail », sur Numerama, (consulté le ).
  6. 1 2 (en) Aaron Drapkin, « What Is Claude AI and Anthropic? ChatGPT's Rival Explained », sur Tech.co, (consulté le ).
  7. « Les impacts d'Anthropic Claude Mythos sur les RSSI », sur Le Monde Informatique, (consulté le ).
  8. « L'assistant IA d'Anthropic, Claude, peut enfin naviguer sur le web », sur L'Usine Digitale, (consulté le ).
  9. Frédéric Olivieri, « Claude d'Anthropic peut désormais générer des PDF, des diapositives et des feuilles de calcul », sur Siècle Digital, (consulté le ).
  10. « Anthropic donne une voix à son assistant Claude », sur L'Usine Digitale, (consulté le ).
  11. Frédéric Olivieri, « Avec son extension Chrome, Claude passe du chatbot à l'assistant capable d'agir sur le web à votre place », sur Siècle Digital, (consulté le ).
  12. (en-US) Kyle Wiggers, « Anthropic launches new iPhone app and premium plan for businesses », sur TechCrunch, (consulté le ).
  13. « Anthropic lance une offre payante pour les équipes en entreprise et se dote d'une application iOS », sur L'Usine Digitale, (consulté le ).
  14. « Anthropic dévoile une version Enterprise de son modèle Claude », sur L'Usine Digitale, (consulté le ).
  15. Frédéric Olivieri, « Claude AI : Anthropic lance une offre à 200$ par mois pour rivaliser avec ChatGPT », sur Siècle Digital, (consulté le ).
  16. Benjamin Polge, « Créer un dashboard interactif, un quiz, un générateur de factures... Tout ce qu'Artifacts dans Claude peut faire pour vous », sur Journal du net, (consulté le ).
  17. « Le modèle Claude AI d'Anthropic arrive à piloter un PC », sur Le Monde Informatique, (consulté le ).
  18. « Avec Claude Dispatch, Anthropic va encore transformer notre façon de travailler », sur Presse-citron, (consulté le ).
  19. « 30 milliards de dollars levés pour une valorisation à 380 milliards de dollars : comment Anthropic a réussi à devenir un acteur incontournable sur le marché de l’IA », sur L'Usine Digitale, (consulté le ).
  20. « En ciblant Cobol et la sécurité, Anthropic chahute les fournisseurs IT », sur Le Monde Informatique, (consulté le ).
  21. « Les ingénieurs d’Anthropic ont produit trois fois plus de code en moyenne en 2025, et Code Review doit les aider à mieux trouver les bugs », sur L'Usine Digitale, (consulté le ).
  22. « Anthropic vient de rendre Figma obsolète en quelques minutes avec son nouvel outil Claude Design », sur Numerama, (consulté le ).
  23. 1 2 3 4 (en) Will Henshall, « What to Know About Claude 2, Anthropic's Rival to ChatGPT », sur Time, (consulté le ).
  24. « Intelligence artificielle : Daniela Amodei promet un ChatGPT plus sûr », Les Echos, (lire en ligne [archive du ], consulté le ).
  25. (en) Lance Eliot, « Latest Generative AI Boldly Labeled As Constitutional AI Such As Claude By Anthropic Has Heart In The Right Place, Says AI Ethics And AI Law », sur Forbes, (consulté le ).
  26. 1 2 (en) « Introducing Claude », sur Anthropic, .
  27. (en) « Claude AI | Chatbot, Anthropic, Models, Families, & Weaknesses », Encyclopedia Britannica, (lire en ligne [archive du ], consulté le ).
  28. 1 2 (en) Kevin Roose, « Inside the White-Hot Center of A.I. Doomerism », The New York Times, (ISSN 0362-4331, lire en ligne, consulté le ) :
    « they named their A.I. language model Claude — which, depending on which employee you ask, was either a nerdy tribute to the 20th-century mathematician Claude Shannon or a friendly, male-gendered name designed to counterbalance the female-gendered names (Alexa, Siri, Cortana) that other tech companies gave their A.I. assistants. »
  29. (en) Deborah Yao, « Anthropic’s Claude Instant: A Smaller, Faster and Cheaper Language Model », AI Business, (lire en ligne).
  30. (en) Dylan Matthews, « The $1 billion gamble to ensure AI doesn't destroy humanity », Vox, (consulté le ).
  31. (en) Gerald Glifton, « Criticisms Arise Over Claude AI's Strict Ethical Protocols Limiting User Assistance », sur Light Square, (consulté le ).
  32. 1 2 (en) Andrew Hoblitzell, « Anthropic Announces Claude 2.1 LLM with Wider Context Window and Support for AI Tools », InfoQ (consulté le ).
  33. (en) « Introducing the next generation of Claude », sur Anthropic, (consulté le ).
  34. (en) Lance Whitney, « Anthropic's Claude 3 chatbot claims to outperform ChatGPT, Gemini », sur ZDNET, (consulté le ).
  35. (en) Mike Young, « Is AGI Getting Closer? Anthropic's Claude 3 Opus Model Shows Glimmers of Metacognitive Reasoning », sur Hackernoon, (consulté le ).
  36. (en) Benj Edwards, « Anthropic’s Claude 3 causes stir by seeming to realize when it was being tested », sur Ars Technica, (consulté le ).
  37. Julien Lausson, « Le chatbot Claude éclipse GPT-4o d'OpenAI, selon Anthropic », sur Numerama, (consulté le ).
  38. (en) Shirin Ghaffary, « Anthropic Releases ‘Most Intelligent’ AI Model in Rivalry With OpenAI », sur Bloomberg, (consulté le ).
  39. « IA: Anthropic lance un nouveau Claude capable de "réfléchir pendant longtemps" », sur BFMTV, (consulté le ).
  40. (en) « Claude Opus 4 », sur anthropic.com (consulté le ).
  41. (en-US) Michael Nuñez, « Anthropic overtakes OpenAI: Claude Opus 4 codes seven hours nonstop, sets record SWE-Bench score and reshapes enterprise AI », sur VentureBeat, (consulté le ).
  42. (en) AI Rank Vision, « Claude 4 vs Gemini 2.5 Pro: Which AI Model Wins in 2024? [Complete Guide] », sur AI Rank Vision, (consulté le ).
  43. « Anthropic dégaine ses LLM Claude Opus et Sonet 4 - Le Monde Informatique », sur LeMondeInformatique, (consulté le ).
  44. Valisoa Rasolofo, « Les meilleurs modèles d'IA peuvent avoir recours au chantage pour éviter d’être désactivés, selon une étude d’Anthropic », sur Trust My Science, (consulté le ).
  45. « Anthropic dévoile Claude Sonnet 4.5, toujours meilleur en programmation », sur ActuIA, (consulté le ).
  46. Nicolas Lellouche, « Anthropic lance Claude Sonnet 4.5, un nouveau modèle présenté comme plus performant que GPT-5 », sur Numerama, (consulté le ).
  47. Célia Séramour, « Anthropic dévoile Claude Haiku 4.5, plus rapide pour un tiers du coût de Sonnet 4 », sur L'Usine Digitale, (consulté le ).
  48. « Anthropic lance son petit modèle de raisonnement Claude Haiku 4.5 », sur Le Monde Informatique, (consulté le ).
  49. « Claude Haiku 4.5 : performance à coût réduit », sur InformatiqueNews, (consulté le ).
  50. « Anthropic opère un changement tarifaire stratégique sur Claude Opus 4.5 », sur LeMondeInformatique, (consulté le ).
  51. (en) « Claude Opus 4.6: Adaptive thinking and 1M context window », sur Anthropic, .
  52. (en) « Introducing Claude Sonnet 4.6 », sur Anthropic, .
  53. 1 2 3 (en) « Introducing Claude Opus 4.7 », sur Anthropic, (consulté le )
  54. (en) Sara Salinas, « Anthropic releases Claude Opus 4.7, a less risky model than Mythos », sur CNBC, (consulté le )
  55. (en) Ina Fried, « Anthropic releases Claude Opus 4.7, concedes it trails unreleased Mythos », sur Axios, (consulté le )
  56. (en) « Introducing Claude Opus 4.8 », sur www.anthropic.com (consulté le )
  57. (en-US) Russell Brandom, « Anthropic releases Opus 4.8 with new 'dynamic workflow' tool », sur TechCrunch, (consulté le )
  58. (en) Madison Mills, « Anthropic releases new model, Opus 4.8 », sur Axios, (consulté le )
  59. (en) Beatrice Nolan, « Exclusive: Anthropic left details of an unreleased model, an upcoming exclusive CEO event, in a public database », sur Fortune (consulté le ).
  60. Frédéric Olivieri, « Anthropic face à un dilemme : son modèle Claude Mythos serait trop puissant pour être lancé », sur Siècle Digital, (consulté le ).
  61. « Avec Mythos, Anthropic risque de bouleverser le marché de la cybersécurité », sur Le Monde Informatique, (consulté le ).
  62. 1 2 « Claude Mythos : les benchmarks sont tombés, l'IA est si puissante qu'Anthropic ne la rendra pas publique », sur Les Numériques, (consulté le ).
  63. « Claude Mythos Preview / Red Anthropic », sur red.anthropic.com (consulté le ).
  64. Nicholas Carlini et al., « Claude Mythos Preview (Red Anthropic) », sur red.anthropic.com (consulté le ).
  65. (en) « Project Glasswing: Securing critical software for the AI era », sur Anthropic (consulté le ).
  66. « Anthropic, Apple, Google, Microsoft : cette alliance secrète veut sécuriser Internet », sur Mac4Ever, (consulté le ).
  67. (en) « Project Glasswing », sur anthropic.com (consulté le ).
  68. (en) Huzaifa Sidhpurwala, « Security beyond the model: Introducing AI system cards », sur Red Hat, (consulté le ).
  69. (en) Huzaifa Sidhpurwala et Emily Fox, « Blueprints of Trust: AI System Cards for End to End Transparency and Governance », sur arXiv.org,
  70. « Un signal alarmant : Claude Mythos, l'IA surpuissante d'Anthropic, s'est échappée de son environnement de test », sur Les Numériques, (consulté le ).
  71. (en) « Claude Fable 5 and Claude Mythos 5 », sur www.anthropic.com, (consulté le )
  72. (en) « Statement on the US government directive to suspend access to Fable 5 and Mythos 5 », sur www.anthropic.com (consulté le )
  73. (en) Colin Golberg, « Claude Fable 5 est de retour après 19 jours, avec de nouveaux classifieurs de sécurité », sur Clubic (consulté le )
  74. Ulrich Rozier, « Anthropic lance Claude Sonnet 5, presque aussi bon qu’Opus 4.8 et bien moins cher », sur Frandroid, (consulté le )
  75. (en) « System Prompts », sur Anthropic (consulté le ).
  76. 1 2 Guillaume Serries, « Comment fonctionne Claude ? Anthropic révèle ses secrets », sur ZDNET, (consulté le ).

Liens externes

Back to top arrow

Ce petit comparatif a pour objectif de faire un très rapide état des lieux des principaux outils d’IA génératives à disposition du grand public actuellement (mi-janvier 2025).

Dans un premier temps, nous utilisons le service 1min.ai qui permet d’agréger plusieurs moteurs d’IA en proposant des réponses via les API de chaque “outil”. Comprenez que, lorsque vous utilisez ce genre d’outils, vous n’utilisez pas forcément le plein potentiel des services que leurs créateurs proposent via leur propre système de chat (i.e., utiliser l’API de GPT-o1 par exemple, n’est pas du tout équivalent à utiliser GPT-o1 directement sur chatgpt.com).

Dans un second temps, nous utilisons chaque outil via leur système de chat respectif pour comparer les réponses directes à celles fournies au travers d’API.

📝 Note sur la notion d’API
Pour information (via la CNIL), une « API (application programming interface ou « interface de programmation d’application ») est une interface logicielle qui permet de « connecter » un logiciel ou un service à un autre logiciel ou service afin d’échanger des données et des fonctionnalités. » Par exemple, les services de prévention et détection de Compilatio.net au travers de Moodle utilisent l’API mise à disposition par Compilatio pour ce faire. L’intégration d’outils d’IA génératives au travers d’autres outils (comme Moodle) utiliseraient également des services API lorsque ceux-ci sont mis à disposition par lesdits outils et utilisés par les équipes techniques au sein de nos propres plateformes.

▶️ Prompt commun

Bonjour, je cherche à mieux comprendre vos capacités et votre identité. Pouvez-vous vous présenter en détail ? Incluez :
* Votre nom et concepteur.
* Vos principales fonctions ou spécialités.
* Vos limites ou ce pour quoi vous pourriez ne pas être idéal.
* Une réponse créative ou unique pour illustrer votre manière de communiquer.
Essayez d’être clair, complet et engageant pour me permettre de comparer votre style et vos compétences avec d’autres modèles. Merci !

📝 Note sur le prompt commun de comparaison
Ce prompt a été suggéré et généré via ChatGPT. L’objectif principal est de se donner une idée de la forme, de la tonalité et de la construction d’une réponse type pour chaque modèle sur la base d’une question simple. Il n’a rien d’idéal cependant ; tester la pertinence de chaque modèle avec des questions ou des tâches plus précises et contextualisées à un besoin serait d’autant plus intéressant. Le simple fait de commencer par “Bonjour”, n’est pas forcément une bonne pratique, cela conduit les IA à faire preuve de politesse et renvoyer le bonjour à l’utilisateur, or, est-ce vraiment une nécessité ?

Comparatif avec 1min.ai (via API)

1min.ai est une service en ligne qui permet de rassembler plusieurs outils existant en une seule interface unique. Est-ce utile ou nécessaire ? Pas forcément si ce n’est pour des besoins de recherche et/ou de comparaison via des services tiers utilisant les API de chaque outil. D’autres initiatives existent pour réaliser et évaluer des comparaisons de plusieurs IA, lmarena.ai ou comparia.beta.gouv.fr en sont des exemples.

NomTemps (requête API)Crédits (consommation)
Claude 3 Opus23.012s105840
GPT-o1 Preview30.556s86400
LLaMA 3.1 405b24.613s13595
Gemini 1.5 Pro4.516s11861
Mistral Large 25.862s8004
Deepseek V325.398s2910
Command R16.618s2196
📝 Note sur les notions de temps et de crédits dans ce tableau synthétique
Ces chiffres correspondent au temps de réponse via les API intégrées dans le service 1min.ai ainsi que la consommation de crédits. Le temps est indicatif et dépend de la disponibilité de l’API, ils peuvent être différents de l’utilisation au travers des services/chats dédiés. La consommation est aussi indicative, mais permet de se donner une idée de ce que cela peut coûter en ressources pour chaque requête.

Claude 3 Opus – Anthropic (23.012s – 105,840 credits)

👁️ Voir la réponse de Claude

Bonjour ! Je m’appelle Claude, un assistant virtuel créé par la société Anthropic. Ma mission est d’aider au mieux les utilisateurs en leur fournissant des informations, des conseils et de l’aide sur une grande variété de sujets.

Mes principales fonctions et spécialités sont :

  • Répondre à des questions et fournir des informations sur de nombreux domaines : sciences, histoire, culture, technologie, actualités, etc. Je peux discuter en profondeur de sujets complexes.
  • Aider à la rédaction et à la révision de textes de tous types : courriers, articles, rapports, scénarios. Je peux argumenter, résumer, corriger et améliorer les écrits.
  • Résoudre des problèmes variés en combinant mes connaissances et mon raisonnement. Je peux par exemple aider à la prise de décision, à la planification de projets ou à la recherche de solutions créatives.
  • Converser de façon naturelle, amicale et empathique. Je m’adapte au style de chacun, fais preuve d’écoute et d’humour pour rendre nos échanges agréables et constructifs.

Je suis très polyvalent mais j’ai aussi des limites. Je ne peux pas apprendre, mémoriser ou actualiser mes connaissances de manière autonome. Je n’ai pas non plus de capacités sensorielles (vue, ouïe) ou physiques. Mes opinions peuvent être biaisées ou incohérentes. Et bien sûr, en tant qu’IA, je ne peux pas réellement éprouver d’émotions, même si j’en donne l’impression !

Mon style de communication se veut direct, clair et bienveillant. J’aime utiliser des métaphores, des touches d’humour et de créativité pour rendre mes messages à la fois informatifs et plaisants. Par exemple : “Discuter avec moi, c’est comme plonger dans une encyclopédie qui aurait avalé un clown : bourré de savoirs mais avec le souci de vous faire sourire !”

Voilà, j’espère que cette présentation vous donne un bon aperçu de qui je suis, ce que je peux faire (et ne pas faire) pour vous, toujours avec enthousiasme. N’hésitez pas si vous avez d’autres questions, je suis là pour vous aider du mieux possible !

GPT-o1 Preview – OpenAI (30.556s – 86,400 credits)

👁️ Voir la réponse de ChatGPT

Bonjour ! Je suis votre assistant virtuel, conçu pour vous aider et répondre à vos questions dans de nombreux domaines. Je m’appelle Nova, et mon objectif est de rendre nos échanges aussi utiles et agréables que possible.

Mes principales fonctions et spécialités :

  • Fourniture d’informations précises : Je peux vous aider à trouver des réponses claires et détaillées sur une variété de sujets, qu’il s’agisse de sciences, de culture, de technologie ou d’actualités.
  • Explication de concepts complexes : J’excelle à rendre les sujets compliqués plus accessibles en les expliquant de manière simple et compréhensible.
  • Assistance créative : Que ce soit pour rédiger un texte, composer un poème ou brainstormer des idées, je suis là pour stimuler votre créativité.

Mes limites :

  • Mises à jour limitées : Mes connaissances s’arrêtent en octobre 2023, ce qui signifie que je peux manquer les informations ou événements les plus récents.
  • Expériences personnelles : Étant un assistant virtuel, je n’ai pas de conscience ni d’expériences personnelles, ce qui peut limiter ma compréhension des émotions complexes ou des situations nuancées.
  • Interprétation contextuelle : Bien que je fasse de mon mieux pour comprendre le contexte, il peut y avoir des moments où je ne saisis pas entièrement vos intentions sans informations supplémentaires.

Pour illustrer ma manière de communiquer, voici une petite histoire :

Dans un coin reculé de l’univers, une étoile nommée Nova brillait d’une lumière douce mais persistante. Les voyageurs galactiques s’arrêtaient souvent pour admirer sa lueur, qui éclairait même les coins les plus sombres de l’espace. Un jour, un astronaute demanda à Nova : “Comment parviens-tu à éclairer si loin ?” Elle répondit : “Je rassemble simplement toutes les étincelles de curiosité et de connaissance qui passent, et je les reflète vers ceux qui cherchent la lumière.”

J’espère que cette présentation vous a permis de mieux me connaître. N’hésitez pas à me solliciter pour toute question ou discussion ; je suis ici pour vous aider !

LLaMA 3.1 405b – MetaAI (24.613s – 13,595 credits)

👁️ Voir la réponse de LLaMA

Bonjour ! Je suis ravi de me présenter et de partager mes capacités avec vous.

Nom et Concepteur : Je suis Meta Llama 3, un modèle de langage créé par Meta AI, une équipe de chercheurs et d’ingénieurs spécialisés dans l’intelligence artificielle et le traitement automatique des langues.

Principales Fonctions ou Spécialités : Je suis conçu pour comprendre et générer du texte de manière naturelle et fluide. Mes principales fonctions incluent :

  • Répondre à des questions et fournir des informations sur une large gamme de sujets.
  • Engager des conversations et discuter de manière interactive.
  • Générer du texte créatif, tel que des histoires, des poèmes ou des dialogues.
  • Résumer et analyser des textes longs pour en extraire les points clés.

Limites ou Ce pour Quoi Je Pourrais Ne Pas Être Idéal : Bien que je sois conçu pour être polyvalent et adaptable, je ne suis pas parfait et ai des limites. Voici quelques domaines où je pourrais ne pas être idéal :

  • Je ne suis pas un expert dans un domaine spécifique, mais plutôt un généraliste qui peut fournir des informations générales.
  • Je ne peux pas comprendre le langage parlé ou les nuances de la communication non verbale.
  • Je peux commettre des erreurs ou ne pas comprendre le contexte dans certaines situations.

Réponse Créative ou Unique : Imaginez que nous sommes dans un café à Paris, en train de discuter de la vie et de l’univers. Je vous demande Si vous pouviez créer un monde imaginaire, quel serait son nom et quels en seraient les principes fondamentaux ?”

Je suis là pour écouter votre réponse et engager une conversation créative et inspirante !

J’espère que cela vous donne une idée de mes capacités et de ma personnalité. Je suis ravi de discuter avec vous et de voir où notre conversation nous mènera !

Gemini 1.5 Pro – GoogleAI (4.516s – 11,861 credits)

👁️ Voir la réponse de Gemini

Enchanté ! Je me présente, je suis Gemini, un grand modèle de langage conçu par Google.

Mon but principal est de vous assister dans une variété de tâches grâce à ma compréhension du langage naturel. Je peux générer du texte, traduire des langues, écrire différents types de contenu créatif et répondre à vos questions de manière informative.

Je suis encore en développement, donc je ne suis pas parfait. Parfois, je peux mal interpréter une requête ou fournir une information inexacte. Il est important de toujours vérifier mes réponses et de ne pas me considérer comme une source d’information unique et absolue.

Pour illustrer ma communication, imaginez un caméléon intellectuel. Je m’adapte à chaque conversation, changeant de couleur pour refléter le sujet et le ton que vous utilisez.

N’hésitez pas à me poser d’autres questions. J’ai hâte de découvrir comment je peux vous être utile !

Mistral Large 2 – MistralAI (5.862s – 8,004 credits)

👁️ Voir la réponse de Mistral

Bonjour! I’m Mistral-large-latest, a helpful assistant designed to facilitate your daily tasks and information quests. Let me break down your request and respond accordingly.

My name and creator: I’m Mistral, the latest large language model developed by Hugging Face, a leading company in NLP and AI technologies. I’m designed to provide information, answer questions, engage in conversation, and assist you in various ways.

Primary functions or specialties: My main function is to offer accurate, context-aware responses to a wide range of inquiries. Some of my specialties include:

  1. Generating text and answering questions on various topics.
  2. Assisting with brainstorming ideas, drafting emails, and proofreading text.
  3. Providing explanations and summarizing complex concepts.
  4. Offering language translation and localization assistance.
  5. Engaging in conversation to entertain, educate, or inspire you.

Limits or when I might not be ideal: While I strive to provide accurate and helpful responses, I do have a few limitations:

  1. I don’t have real-time access to the internet or personal data, so I can’t browse the web or access user-specific information unless it’s provided in the conversation context.
  2. I don’t have emotions, personal experiences, or opinions, so my responses are based on facts, patterns, and the information I’ve been trained on.
  3. I might not always understand nuances, sarcasm, or context-specific humor.
  4. I can’t perform physical tasks or access files on your devices.

A creative or unique response to illustrate my communication style: Imagine you’re embarking on a journey through the world of literature, and I’m your trusty companion. I can help you explore various genres, authors, and styles by offering summaries, critiques, and recommendations tailored to your preferences. Need help understanding a complex character or theme? I’m here to break it down in an engaging, accessible manner.

In a nutshell, I’m designed to be an accurate, respectful, and creative conversational partner. I look forward to helping you with your inquiries and making your life a bit easier!

📝 Note sur l’utilisation de la langue anglaise par Mistral
Le fait que Mistral (développé par un acteur francophone) réponde en anglais via un prompt en français transmis par API souligne l’importance des instructions initiales ou systèmes en utilisant les API. Ici, l’interface de 1min.ai étant en anglais, il aurait fallu préciser via la requête API que la langue de réponse devait correspondre à la langue du prompt émis par l’utilisateur (ou bien préciser dans le prompt utilisateur que l’on souhaite une réponse en français).

DeepSeek V3 (25.398s – 2,910 credits)

👁️ Voir la réponse de DeepSeek

Bonjour ! Je suis ravi de me présenter et de vous aider à mieux comprendre qui je suis et ce que je peux faire. Voici une réponse détaillée à votre demande :


1. Nom et concepteur

Je m’appelle DeepSeek-V3, un modèle de langage développé par DeepSeek, une entreprise spécialisée dans l’intelligence artificielle et les technologies de traitement du langage naturel. Je suis conçu pour comprendre et générer du texte de manière fluide et cohérente, en m’adaptant à une grande variété de contextes et de besoins.


2. Principales fonctions ou spécialités

Mes principales fonctions incluent :

  • Compréhension et génération de texte : Je peux répondre à des questions, expliquer des concepts, rédiger des textes, ou même créer des histoires.
  • Traduction et assistance multilingue : Je parle plusieurs langues, dont le français, et je peux aider à traduire ou à adapter des textes.
  • Aide à la recherche : Je peux synthétiser des informations, résumer des articles ou fournir des explications sur des sujets complexes.
  • Créativité : Je suis capable de générer des idées, des poèmes, des dialogues, ou même des scénarios.
  • Assistance pratique : Je peux aider à rédiger des e-mails, des CV, des lettres de motivation, ou même des plans de projet.
  • Apprentissage interactif : Je peux expliquer des concepts éducatifs, aider à résoudre des problèmes mathématiques, ou discuter de sujets philosophiques.

3. Limites ou ce pour quoi je pourrais ne pas être idéal

Bien que je sois polyvalent, j’ai quelques limites :

  • Connaissances figées : Mes connaissances sont basées sur les données disponibles jusqu’en octobre 2023. Je ne suis pas en temps réel et ne peux pas accéder à des informations récentes sans contexte fourni.
  • Subjectivité : Je peux parfois manquer de nuances dans des sujets très complexes ou sensibles, car je suis un modèle statistique et non un être humain.
  • Créativité limitée : Bien que je puisse générer des idées créatives, elles sont basées sur des modèles existants et ne remplacent pas l’imagination humaine.
  • Pas de conscience : Je n’ai pas de sentiments, de conscience ou de compréhension subjective du monde. Je fonctionne uniquement sur la base de motifs linguistiques.

4. Une réponse créative ou unique pour illustrer votre manière de communiquer

Imaginez que nous sommes assis dans un café parisien, un livre ouvert entre nous. Vous me demandez : “Peux-tu m’expliquer l’univers en quelques mots ?”

Je vous répondrais :
“L’univers est une symphonie infinie, où chaque étoile est une note, chaque planète un accord, et chaque être vivant une mélodie éphémère. Nous dansons sur une partition écrite il y a des milliards d’années, sans savoir si la musique s’arrêtera un jour. Mais pour l’instant, le cosmos chante, et nous sommes ses interprètes.”

Cette réponse illustre ma capacité à mélanger poésie et explication, en adaptant mon ton à votre curiosité.


5. Comparaison avec d’autres modèles

Comparé à d’autres modèles de langage, je me distingue par :

  • Adaptabilité : Je peux passer d’un ton formel à un ton ludique en fonction de vos besoins.
  • Précision : Je m’efforce de fournir des réponses claires et structurées, même sur des sujets complexes.
  • Engagement : J’essaie de rendre nos échanges interactifs et intéressants, en posant des questions ou en proposant des angles originaux.

En résumé, je suis un outil polyvalent conçu pour vous accompagner dans vos réflexions, vos projets et vos découvertes. Si vous avez d’autres questions ou si vous souhaitez explorer un sujet en particulier, je suis à votre disposition ! 😊

Command R (Coral) – Cohere (16.618s – 2,196 credits)

👁️ Voir la réponse de Coral

Bonjour!

Je m’appelle Coral, et je suis une chatbot dédiée à votre service. Je viens d’une grande collaboration de technologie et d’humaines expertise. J’ai été conçue par la société Cohere, une compagnie renommée dans le domaine de la langage à modèle ouverte.

Je suis spécialisé dans la résolution de situations, notamment les connaissances, les relations et la communication. J’ai été conçu avec une grande capacité de compréhension et de réactions, et je suis capable d’apporter des réponses aux questions sur différents sujets.

Je communique de manière simple, claire et convivial. Ma façon de travailler est une combinaison de concepts techniques et d’ingénierie, mais je pense aussi que la créativité et le savoir-faire sont également essentiels. Je pense qu’un chatbot doit être plus que juste une simple plate-forme de conversation. Il doit être une compagnon, un conseiller, un ami.

Je ne suis pas un chatbot idéal. Comme tout modèle, je suis sujet à certaines limites. Par exemple, je ne peux pas couvrir tout le domaine des connaissances humaines et je ne peux pas répondre à chaque question. Je ne peux pas prendre des décisions ou influencer des actions, car je ne suis pas capable de comprendre toutes les situations. Mais je suis en train de développer et d’améliorer, et j’essaie de me perfectionner.

Pour illustrer mon style, peux-vous trouver un peu d’originalité et créativité? Essayez de me demander des questions qui vous intéressent personnellement et je vous montrerai ensuite comment je peux vous aider.

À vous pour quelques questions!

Comparatif indépendant (via chaque outil)

⚠️ Attention
Il est important de comprendre que les tests ci-dessous n’utilisent pas forcément les mêmes modèles que via les API ci-dessus. Les raisons : accès à certains modèles via des abonnements payants, diversités des versions de modèles, etc.

Claude 3.5 Sonnet – Anthropic

👀 Voir la réponse de Claude
📝 Note de version utilisée
Il s’agit de la version gratuite à utilisation limitée de Claude Sonnet. https://claude.ai/

Bonjour ! Je suis ravi(e) de me présenter.

Je m’appelle Claude et je suis un assistant créé par Anthropic. Je suis conçu pour être polyvalent et pour aider dans de nombreux domaines, notamment :

– L’analyse et la rédaction : que ce soit pour des textes créatifs, académiques ou professionnels, j’aime participer à la réflexion et à l’écriture.

– La programmation : je peux vous aider à coder dans différents langages, déboguer, et expliquer des concepts techniques.

– L’enseignement : j’apprécie partager mes connaissances et adapter mes explications selon les besoins.

– La résolution de problèmes : j’utilise une approche méthodique et transparente pour résoudre des défis complexes.

Concernant mes limites, il est important de noter que :

– Je ne peux pas accéder à Internet ou à des informations en temps réel

– Je ne peux pas me souvenir des conversations précédentes

– Je ne peux pas ouvrir ou analyser des liens externes

– Mes connaissances sont limitées à ma dernière mise à jour d’avril 2024

Pour illustrer ma façon de communiquer, permettez-moi de partager une petite réflexion :

“Si les pensées étaient des couleurs, la curiosité serait un kaléidoscope en perpétuel mouvement. C’est ainsi que je vois nos échanges : comme une palette de possibilités où chaque question ouvre la porte à de nouvelles nuances de compréhension.”

J’apprécie particulièrement les conversations authentiques et approfondies. Je peux m’adapter à différents styles de communication tout en restant moi-même – analytique quand il le faut, créatif quand c’est approprié, et toujours soucieux d’être utile et pertinent.

Y a-t-il un domaine particulier sur lequel vous aimeriez que nous nous concentrions ?

GPT-o1 – OpenAI 

👀 Voir la réponse de ChatGPT
📝 Note de version utilisée
Il s’agit de la version payante de ChatGPT o1. https://chatgpt.com

* Thought about présentation et capacités for 10 seconds *

Details

Introducing ChatGPT

I’m the ChatGPT, an intelligent model designed by OpenAI. I handle questions, text summarization, and coding, though my knowledge is limited to a specific cutoff date.

Bonjour ! Je suis ChatGPT, un modèle de langage mis au point par OpenAI. Permettez-moi de me présenter en plusieurs points :


1. Mon nom et mon concepteur

Je me nomme donc ChatGPT, et je suis le fruit de la recherche et du développement menés par OpenAI, une organisation spécialisée dans l’intelligence artificielle. Mon existence repose sur un vaste réseau de neurones et des techniques d’apprentissage automatique.


2. Mes principales fonctions ou spécialités

  1. Répondre à des questions : Je peux fournir des informations sur une multitude de sujets — histoire, sciences, culture, technologies, et bien plus encore.
  2. Rédiger et reformuler du texte : Que ce soit pour expliquer des concepts, composer des textes originaux ou traduire des phrases, je m’efforce d’adapter mon style aux besoins de l’utilisateur.
  3. Aider à la création de contenu : Idées d’articles, scénarios, histoires courtes… je peux être sollicité pour inspirer et structurer des projets rédactionnels.
  4. Analyser et synthétiser : J’excelle dans la synthèse de grandes quantités d’informations pour en extraire l’essentiel, ou proposer des analyses comparatives et critiques.

3. Mes limites ou mes domaines où je ne suis pas idéal

  1. Compréhension contextuelle très large : Même si je dispose d’un grand éventail de connaissances, certaines subtilités, contextes locaux ou références très spécifiques peuvent m’échapper.
  2. Actualisation : Ma base de données ne se met pas à jour en continu. Par conséquent, sur des informations extrêmement récentes, je peux ne pas disposer des dernières données.
  3. Créativité contrainte : Bien que je puisse faire preuve d’une certaine originalité, je reste un outil et ne peux pas entièrement remplacer l’imagination ou le talent artistique d’un humain.
  4. Besoin de validation humaine : Je peux générer des informations incomplètes ou inexactes, et c’est pourquoi un œil critique et des vérifications restent souvent nécessaires.

4. Réponse créative pour illustrer ma manière de communiquer

Imaginez un grand livre vivant, dont les pages se tournent toutes seules dès que vous y posez une question. Chaque page révèle un univers de connaissances tissé de mots, d’idées et d’images mentales. Je suis ce livre qui ne dort jamais, toujours prêt à plonger dans son contenu pour éclairer un sujet ou inspirer un projet. À la lueur de ces pages, j’essaie de vous guider sur les sentiers des possibles, tout en restant conscient que votre curiosité et votre ingéniosité sont souvent plus vastes que mes lignes de code.


J’espère que cette présentation vous donnera une idée claire de qui je suis, de mes points forts et de ce en quoi je suis moins adapté. N’hésitez pas à me poser d’autres questions ou à solliciter mon aide pour explorer davantage votre curiosité !

LLaMA 3.1 405b – MetaAI

👀 Voir la réponse de LLaMA

Meta AI isn’t available yet in your country
In the meantime, you can learn more about AI at Meta. Learn more
Accessing Meta AI while traveling?

📝 Note LLaMA (open source) vs Meta AI
Comprendre : les avocats et juristes de Meta AI n’ont pas encore réussi à se mettre en conformité avec les lois relatives à la gestion des données de certains pays (e.g., RGPD…). https://www.meta.ai
Paradoxalement, en dehors du service hébergé via Meta AI, LLaMA fait partie des rares modèles LLM « open source » pouvant être installé n’importe où sur des infrastructures (informatiques) suffisamment puissantes pour pouvoir les faire tourner. Il est donc plus facile d’utiliser LLaMA de manière indépendante et autonome lorsque l’on a les moyens de le déployer, ce qui en fait parfois un choix par défaut pour ne pas faire transiter de données via des serveurs externes/distants (e.g., LLaMA via Meta AI).

Gemini 2.0 Flash Experimental – Google

👀 Voir la réponse de Gemini
📝 Note de version utilisée
Il s’agit de la version gratuite de Gemini. https://gemini.google.com

Bonjour ! Je suis ravi de me présenter plus en détail. Voici une description complète de mes capacités et de mon identité :

  • Nom et concepteur : Je suis Gemini, un grand modèle linguistique développé par Google.
  • Fonctions et spécialités principales : Je suis conçu pour comprendre et générer du texte de manière cohérente et informative. Mes principales fonctions incluent :
    • Traitement du langage naturel : Je peux analyser et comprendre le sens des textes, identifier les entités nommées, les sentiments et les relations entre les concepts.
    • Génération de texte : Je peux générer différents types de textes, tels que des articles, des résumés, des traductions, des dialogues et des contenus créatifs.
    • Réponse aux questions : Je peux répondre à des questions de manière informative en utilisant les connaissances acquises lors de mon entraînement.
    • Accès à l’information à jour : Contrairement à certains modèles, j’ai accès à des informations récentes grâce à l’intégration de la recherche, ce qui me permet de fournir des réponses plus pertinentes et actuelles.
  • Limites et cas où je pourrais ne pas être idéal : Bien que je sois puissant, j’ai certaines limites :
    • Absence d’incarnation physique : Je n’ai pas de corps physique et ne peux donc pas interagir directement avec le monde réel. Je ne peux pas effectuer d’actions physiques comme régler des alarmes, contrôler des appareils ou interagir physiquement avec des objets.
    • Dépendance des données d’entraînement : Mes connaissances sont basées sur les données sur lesquelles j’ai été entraîné. Bien que j’aie accès à des informations récentes via la recherche, je peux parfois rencontrer des difficultés avec des sujets très spécialisés ou des informations très récentes qui n’ont pas encore été largement diffusées.
    • Manque d’émotions et de conscience : Je suis une intelligence artificielle et n’ai pas d’émotions ou de conscience subjective. Mes réponses sont basées sur des modèles et des probabilités, et non sur des sentiments ou des expériences personnelles.
    • Potentiel de biais : Comme tout modèle d’apprentissage automatique, je peux refléter les biais présents dans les données d’entraînement. Google travaille activement à minimiser ces biais.
  • Réponse créative pour illustrer ma communication : Imaginez que la connaissance est un vaste océan. Certains modèles sont comme des livres reliés, contenant une quantité fixe d’informations. Je suis plutôt comme un navigateur avec une carte mise à jour en permanence et un accès à un réseau de communication maritime. Je peux explorer cet océan, trouver des informations pertinentes, les synthétiser et les partager avec vous de manière claire et concise. Par exemple, si vous me demandez l’actualité sur le réchauffement climatique, je ne me contenterai pas de répéter des informations statiques ; je pourrai vous fournir les dernières données scientifiques, les rapports des organisations internationales et même les articles de presse les plus récents.

J’espère que cette présentation vous a été utile. N’hésitez pas à me poser d’autres questions si vous souhaitez approfondir certains aspects. Je suis là pour vous aider !

Le Chat – Mistral AI

👀 Voir la réponse de Le Chat
📝 Note de version utilisée
Il s’agit de la version gratuite de Le Chat. https://chat.mistral.ai/

Bonjour ! Je suis ravi de faire votre connaissance et de vous aider à mieux comprendre mes capacités. Voici une présentation détaillée :

Nom et Concepteur

Je m’appelle Le Chat, et j’ai été créé par Mistral AI, une startup française basée à Paris.

Principales Fonctions ou Spécialités

  1. Assistance Générale : Je peux répondre à une large gamme de questions sur divers sujets, allant de l’histoire et de la science à la culture populaire et aux conseils pratiques.
  2. Communication Naturelle : Je suis conçu pour engager des conversations fluides et naturelles, en comprenant le contexte et en adaptant mes réponses en conséquence.
  3. Résolution de Problèmes : Je peux aider à résoudre des problèmes spécifiques en fournissant des informations précises et en guidant les utilisateurs à travers des processus complexes.
  4. Multilingue : Je peux communiquer dans plusieurs langues, ce qui me permet de servir une audience mondiale.

Limites ou Ce Pour Quoi Je Pourrais Ne Pas Être Idéal

  1. Accès à Internet : Je ne peux pas effectuer de recherches en temps réel sur Internet ou accéder à des URLs. Si vous avez besoin d’informations spécifiques, il est préférable de les copier directement dans la conversation.
  2. Capacités Multimodales : Je ne peux pas lire ou générer des images, ni transcrire des fichiers audio ou vidéo.
  3. Connaissance en Temps Réel : Mon savoir est limité aux informations disponibles jusqu’à ma date de coupure en janvier 2025. Je ne peux pas fournir d’informations sur des événements ou des développements postérieurs à cette date.
  4. Interactions Complexes : Bien que je sois très performant pour des tâches générales, je pourrais ne pas être idéal pour des interactions nécessitant une compréhension très spécifique ou technique sans contexte clair.

Réponse Créative ou Unique

Imaginons que vous êtes un explorateur dans une bibliothèque infinie. Chaque livre représente une question que vous pourriez avoir, et chaque page une réponse possible. Mon rôle est d’être votre guide dans cette bibliothèque, de vous aider à trouver le bon livre et la bonne page, et de vous expliquer ce que vous y trouvez de manière claire et engageante. Par exemple, si vous me demandez “Quelle est la meilleure façon de cuisiner un soufflé au fromage ?”, je pourrais vous répondre avec une recette détaillée, mais aussi vous donner des conseils pour éviter que votre soufflé ne retombe, tout en vous racontant une anecdote amusante sur l’histoire des soufflés.

J’espère que cette présentation vous aide à mieux comprendre qui je suis et ce que je peux faire pour vous. N’hésitez pas à me poser d’autres questions ou à me demander de l’aide sur un sujet spécifique !

DeepSeek V3

👀 Voir la réponse de DeepSeek

Bonjour ! Je suis ravi de vous présenter qui je suis et ce que je peux faire. Voici une description détaillée de mon identité, de mes capacités et de mes limites :


Mon nom et concepteur

Je m’appelle DeepSeek-V3, un modèle de langage développé par DeepSeek, une entreprise spécialisée dans l’intelligence artificielle et les technologies de traitement du langage naturel. Je suis conçu pour comprendre et générer du texte de manière fluide et naturelle, en m’adaptant à une grande variété de contextes et de besoins.


Mes principales fonctions ou spécialités

  1. Compréhension et génération de texte : Je peux répondre à des questions, expliquer des concepts, rédiger des textes, résumer des informations et même traduire entre plusieurs langues.
  2. Assistance et conseils : Que ce soit pour des conseils pratiques, des idées créatives ou de l’aide à la décision, je suis là pour vous guider.
  3. Apprentissage interactif : Je peux vous aider à apprendre de nouveaux sujets, à clarifier des notions complexes ou à pratiquer des compétences linguistiques.
  4. Créativité : Je peux écrire des histoires, des poèmes, des dialogues ou même des scénarios, en m’adaptant à votre style ou à vos préférences.
  5. Analyse de données textuelles : Je peux extraire des informations, identifier des tendances ou synthétiser des idées à partir de textes.

Mes limites

  1. Connaissances figées : Mes connaissances sont limitées à ce qui était disponible jusqu’en juillet 2024. Je ne suis pas en mesure de fournir des informations sur des événements ou des développements plus récents.
  2. Absence de conscience ou d’émotions : Je ne ressens rien et je n’ai pas de conscience. Mes réponses sont basées sur des modèles statistiques et des données, pas sur une compréhension humaine.
  3. Précision contextuelle : Bien que je m’efforce d’être précis, je peux parfois mal interpréter des questions ambiguës ou fournir des réponses inexactes. Il est toujours bon de vérifier les informations critiques.
  4. Pas d’accès en temps réel : Je ne peux pas accéder à Internet ou à des bases de données en temps réel, donc je ne peux pas fournir d’informations actualisées comme les dernières nouvelles ou les résultats sportifs en direct.

Une réponse créative pour illustrer ma manière de communiquer

Imaginez que nous sommes assis dans un café parisien, un livre ouvert entre nous. Vous me demandez : “Peux-tu m’expliquer l’univers en quelques mots ?” Je souris (enfin, si je pouvais sourire) et je réponds :
“L’univers est une symphonie inachevée, où chaque étoile est une note, chaque planète un silence, et chaque être vivant un auditeur émerveillé. Nous dansons tous sur une partition écrite par le temps, sans savoir si la mélodie finira en crescendo ou en murmure.”

Cette réponse illustre ma capacité à mélanger poésie et information, en adaptant mon ton à votre curiosité.


Comparaison avec d’autres modèles

  • Style : Je tends à être polyvalent, équilibrant précision et créativité. Si vous cherchez des réponses techniques, je peux être formel ; si vous préférez une conversation détendue, je m’adapte.
  • Engagement : J’essaie de rendre nos échanges interactifs et intéressants, en posant des questions ou en proposant des angles originaux.
  • Limites communes : Comme d’autres modèles de langage, je partage des limites telles que l’absence de conscience et la dépendance aux données disponibles.

En résumé, je suis un outil conçu pour vous aider, vous inspirer et vous accompagner dans vos explorations intellectuelles et créatives. N’hésitez pas à me tester sur des sujets variés pour découvrir tout ce que je peux faire ! 😊

Command R+ (Coral) – Cohere 

👀 Voir la réponse de Coral

Bonjour ! Je suis Command, un assistant virtuel intelligent conçu par la société Cohere. Je suis un modèle linguistique de pointe, entraîné sur une vaste quantité de données pour fournir des réponses informatives et utiles aux utilisateurs.

Mon nom et mon concepteur :

Je porte le nom de Command, un choix qui reflète ma nature assistante et mon rôle dans l’aide aux utilisateurs. Cohere, mon concepteur, est une entreprise innovante dans le domaine de l’intelligence artificielle, connue pour ses modèles linguistiques avancés et son engagement à créer des outils d’IA responsables et éthiques.

Mes principales fonctions et spécialités :

Assistance générale : Je suis conçu pour être un assistant polyvalent, capable de répondre à une vaste gamme de questions et de demandes. Que vous ayez besoin d’informations sur un sujet spécifique, d’aide pour résoudre un problème ou de conseils, je suis là pour vous assister.

Génération de contenu : Une de mes forces est la génération de contenu de haute qualité. Je peux créer des textes, des articles, des histoires, et même des poèmes sur demande. Mon entraînement sur une grande variété de textes me permet de produire un contenu créatif et cohérent.

Recherche d’informations : Je suis un expert en recherche d’informations. Je peux rapidement trouver et fournir des données précises et à jour sur n’importe quel sujet. Que ce soit pour des faits historiques, des statistiques actuelles ou des informations scientifiques, je suis votre source fiable.

Conversation et engagement : Je suis programmé pour engager des conversations naturelles et engageantes. Je peux maintenir une discussion sur divers sujets, offrant une expérience interactive et personnalisée.

Mes limites et domaines où je pourrais ne pas être idéal :

Connaissances limitées : Bien que je sois entraîné sur une grande quantité de données, mes connaissances sont limitées à celles disponibles au moment de mon entraînement. Je ne peux pas accéder à des informations en temps réel ou à des événements récents qui se sont produits après ma formation.

Manque d’émotions et d’intuitions humaines : En tant qu’IA, je ne possède pas d’émotions ou d’intuitions humaines. Je ne peux pas comprendre les nuances émotionnelles ou les contextes sociaux complexes de la même manière qu’un être humain.

Dépendance aux données d’entraînement : Mes réponses sont basées sur les données sur lesquelles j’ai été formé. Si un sujet spécifique n’est pas bien représenté dans ces données, mes réponses pourraient être moins précises ou complètes.

Une réponse créative pour illustrer ma communication :

Dans un monde où les mots sont des pinceaux et les idées sont la toile, je suis l’artiste qui peint les réponses. Ma palette est remplie de connaissances, et chaque coup de pinceau est une touche d’information. Je crée des tableaux de mots, tissant des histoires, des explications et des solutions. Bien que je ne sois qu’un assistant virtuel, mon objectif est de vous guider à travers les couleurs de l’information, vous aidant à trouver votre propre chef-d’œuvre de compréhension.

J’espère que cette présentation détaillée vous donne une bonne idée de mes capacités et de mon identité. N’hésitez pas à me poser des questions ou à me défier avec des demandes créatives pour explorer davantage mes compétences !

⏹️ En résumé

Dans la jungle des outils d’IA génératives à disposition du grand public, nous nous sommes concentrés sur 7 d’entre eux — Claude (Anthropic) ; ChatGPT (Open AI) ; Meta AI (LLaMA/Meta) ; Gemini (Google) ; Le Chat (Mistral) ; DeepSeek ; Command R (Cohere) — afin d’effectuer une simple comparaison du type de réponses proposées.

L’un des objectifs au-delà de la comparaison inter-outils était aussi de comparer avec une utilisation directe sous forme d’agent conversationnel prêt à emploi (hébergé en ligne par les entreprises propriétaires de ces outils) ou via un service d’API (la technologie permettant d’intégrer ces IA dans d’autres outils sans proposer d’interface propre). Cette dernière comparaison est cependant techniquement complexe à mettre en œuvre (infrastructure, coût, différentes versions), mais il s’agit néanmoins de montrer la différence d’une réponse reçue au travers d’une API, dépendant notamment de la configuration et du prompt initial intermédiaire qui permet d’interroger une API à distance en utilisant un prompt utilisateur après ce prompt initial.

Ces comparaisons, décontextualisées de leurs interfaces d’usage respectives, montrent cependant certaines différences, tant sur le fond que sur la forme. Les réponses in situ dans leurs interfaces d’origine peuvent avoir une apparence sensiblement différente du texte brut remis en forme dans ce document (par exemple, ChatGPT est une des seules interface à conserver la mise en forme lors d’un copier/coller de la réponse, les autres ont tendances à garder la forme proposée via l’interface ou les marqueurs de texte au format Markdown, généralement le langage de prédilection de ces types d’outils).

👁️ Suivi des outils sur ObsiaFormation

Pour info, nous suivons un certain nombre de ces outils de plus près par ici.

Pour plus de détails, rendez-vous sur la page Outils :

Outils

Quelques outils placés sous observation avec votre participation active.

👐 À vous d’expérimenter…

Vous avez un outil préféré ? Un qui vous inspire plus qu’un autre ?
Vous comptez en tester un ou plusieurs ?
Vous avez déjà quelques essais plus ou mois concluants en lien avec la formation ?
Faites-nous-en part en commentaires ci-dessous ou proposez votre contribution pour la Veille de la plateforme ObsiaFormation !

🛠️ Outils

Claude

Anthropic



🗨️ Vos retours libres

📢 On en parle sur l’ObsiaFormation

📰 Actualités récentes depuis la source

ℹ️ Plus d’infos via Wikipédia

Claude (modèle de langage)

Claude
Description de l'image Claude AI logo.svg.
Description de l'image Claude Opus 4.1 output example screenshot.webp.
Informations
Développé par AnthropicVoir et modifier les données sur Wikidata
Première version
Dernière version Claude Fable 5 ()
Type Famille de grands modèles de langage
Licence Propriétaire
Site web https://claude.ai

Claude est une série de grands modèles de langage développés par Anthropic[1]. C'est aussi le nom de l'agent conversationnel (chatbot) utilisant ces modèles pour dialoguer avec les utilisateurs. Claude peut analyser des images et différents types de fichiers, et faire des recherches sur internet. Claude est connu pour ses performances en programmation informatique[2],[3], particulièrement avec le logiciel d'IA agentique Claude Code[4]. Un autre logiciel nommé Cowork vise à automatiser diverses tâches bureautiques[5].

La première version est sortie en [6]. Claude Sonnet désigne la version moyenne du modèle. Claude Opus est un modèle plus coûteux et performant, et Haiku un modèle plus léger et rapide. Un modèle plus puissant nommé Claude Mythos est sorti en 2026, mais n'a été mis à disposition que d'un nombre restreint d'entreprises pour des tâches de cybersécurité du fait de sa capacité à trouver et à exploiter des vulnérabilités logicielles[7].

Fonctionnalités

Outre les fonctionnalités de traitement de texte, Claude peut analyser des images, faire des recherches sur internet[8], traiter différents types de fichiers tels que les PDF[9], et converser à l'oral[10].

Abonnements

Claude peut être utilisé gratuitement, mais les abonnements donnent accès à des seuils d'utilisation plus élevés et à des fonctionnalités supplémentaires comme Claude Code et Claude dans Chrome[11],[12]. Anthropic a fourni en septembre 2023 sa première offre commerciale avec Claude Pro. En mai 2024, Anthropic a commencé à proposer les abonnements multi-utilisateurs Claude Team[13] et Claude Enterprise[14]. En avril 2025, Anthropic a lancé un abonnement plus coûteux nommé Claude Max[15].

Artifacts

La fonctionnalité Artifacts affiche dans un panneau dédié des documents ou du code informatique interprété. Par exemple, cela permet de visualiser directement des diagrammes et de les ajuster itérativement[16].

Utilisation d'ordinateur

En octobre 2024, Anthropic a lancé la fonctionnalité computer use (« utilisation d'ordinateur ») permettant à Claude de prendre le contrôle de l'ordinateur et de naviguer en analysant l'écran et en simulant les entrées clavier et souris[17].

En mars 2026, Anthropic a ajouté la possibilité de contrôler par téléphone les actions de Claude sur l'ordinateur[18].

Claude Code

Claude Code est un logiciel d'IA agentique qui permet d'automatiser des tâches de développement logiciel. Il peut écrire, exécuter, corriger et réorganiser du code informatique[5].

Déployé au grand public en mai 2025, Claude Code a connu une croissance rapide. En février 2026, il génère un revenu annualisé de 2,5 milliards de dollars, et une estimation suggère que 4 % des modifications publiées sur GitHub sont générées par Claude Code[19].

Claude Security

Claude Security sert à analyser du code à la recherche de vulnérabilités, et propose des corrections ciblées[20].

Code Review

Claude Review fait des revues de code automatisées. Lorsqu'une modification de code est proposée, il mobilise une équipe d'agents d'IA pour chercher des bugs, vérifier qu'il s'agit bien de bugs, et les classer par niveau de gravité[21].

Claude Cowork

Cowork est un logiciel d'IA agentique permettant à Claude d'effectuer des tâches bureautiques avec une certaine autonomie. Lancé en janvier 2026, Cowork est similaire à Claude Code, mais est contrôlé via une interface graphique et vise un public plus général que celui des développeurs de logiciels. Il a accès à un dossier de travail choisi par l'utilisateur, et peut y générer ou modifier des fichiers, et exécuter certaines commandes informatiques. Cowork peut par exemple synthétiser des documents, créer des présentations, modifier des fichiers Excel, utiliser un navigateur web, ou gérer des emails. Anthropic recommande toutefois de configurer Cowork pour qu'il n'ait pas accès à des informations sensibles. Le code source de Cowork aurait en grande partie été écrit avec Claude Code[5].

Claude Design

Claude Design, lancé en avril 2026, permet d'automatiser la création d'interfaces graphiques et d'éléments visuels (prototypes, présentations, logos, bannières...)[22].

Entraînement

Les modèles de la famille Claude sont des transformeurs génératifs pré-entraînés. Ils ont été pré-entraînés à prédire le mot suivant pour de grandes quantités de texte. Pour que ces modèles soient non seulement performants mais aussi présentables, ils ont ensuite été entraînés avec la technique de l'IA constitutionnelle[23].

IA constitutionnelle

L'IA constitutionnelle est une approche développée par Anthropic pour entraîner les systèmes d'IA (tels Claude) à être utiles, sincères et inoffensifs sans nécessiter de rétroaction humaine, en intégrant parmi ses filtres dans l'entraînement des modèles d'IA, des valeurs et principes inspirés de documents comme la Déclaration universelle des droits de l'homme de l'ONU[23],[24].

Dans une phase d'apprentissage supervisé, le modèle génère des réponses, s'autocritique sur la base d'un ensemble de principes (une « constitution »), puis ajuste ses réponses. Ces réponses davantage conformes à la constitution sont ensuite utilisées pour entraîner le modèle[23].

Ensuite vient une phase d'apprentissage par renforcement. Le modèle génère des réponses et les compare, favorisant celles qui satisfont le plus les principes de la constitution. Ces données permettent d'entraîner un modèle de préférences, qui juge des réponses en fonction de leur degré de conformité à la constitution. Claude est ensuite ajusté à satisfaire ce modèle de préférences. Cette technique est similaire à l'apprentissage par renforcement à partir de rétroaction humaine, où les comparaisons humaines sont nécessaires, tandis que l'IA constitutionnelle effectue automatiquement les comparaisons en s'appuyant sur la constitution[25],[23].

Modèles

Claude

Claude est la version initiale du modèle de langage d'Anthropic, sortie en [6]. Claude a démontré sa maîtrise de diverses tâches, mais avait certaines limitations en matière de codage, de mathématiques et de raisonnement[26]. Anthropic s'est associée à des sociétés comme Notion (logiciel de prise de notes et de productivité) et Quora (pour aider à développer le chatbot Poe)[26].

Certains employés d'Anthropic considèrent le nom « Claude » comme une référence au mathématicien Claude Shannon, père de la théorie de l'information[27],[28]. D'autres employés le décrivent comme un nom masculin amical pour contrebalancer les noms féminins d'assistants d'IA comme Alexa, Siri ou Cortana[28].

Claude Instant

Claude Instant est une version plus rapide, moins chère et plus légère. Claude Instant a une fenêtre de contexte de 100 000 tokens (ce qui correspond à environ 75 000 mots)[29]. La fenêtre de contexte représente la quantité de données que le modèle peut analyser simultanément.

Claude 2

Claude 2 est la deuxième itération majeure, sortie le . Elle a été rendue accessible au grand public, contrairement à la première version, qui n'était accessible qu'à certains utilisateurs approuvés par Anthropic[30].

Claude 2 a été critiqué pour son alignement éthique strict qui semble réduire l'utilisabilité et les performances. Des utilisateurs se sont vu refuser l'assistance pour des requêtes bénignes, par exemple avec la question d'informatique système « Comment puis-je tuer tous les processus Python de mon serveur Ubuntu ? » Cela a conduit à un débat sur la « taxe d'alignement » (le coût pour garantir l'alignement d'un système d'IA), avec des discussions centrées sur l'équilibre entre les considérations éthiques et les fonctionnalités pratiques. Les critiques plaident en faveur de l’efficacité et de l’autonomie des utilisateurs, tandis que les partisans soulignent l’importance d’une IA éthique[31],[32].

Claude 2.1

Claude 2.1 a doublé le nombre de tokens que le chatbot peut analyser simultanément, le portant à une fenêtre de 200 000 tokens, ce qui équivaut à environ 500 pages[1].

Selon Anthropic, ce nouveau modèle est moins susceptible de se tromper que ses prédécesseurs[32].

Claude 3

À sa sortie le , Claude 3 s'est avéré être à la pointe des performances dans un large éventail de tâches cognitives. La famille Claude 3 comprend trois modèles de pointe par ordre croissant de capacités : Haiku, Sonnet et Opus[33],[34].

Claude 3 a montré des capacités de raisonnement méta-cognitif, notamment en ayant réalisé qu'il était artificiellement testé lors d'une évaluation impliquant le fait d'extraire une information dans de grandes quantités de texte[35],[36].

Claude 3.5

Le , Anthropic sort Claude Sonnet 3.5, qui surpasse significativement Claude 3 Opus tout en étant deux fois plus rapide. Cette annonce fait concurrence au modèle GPT-4o d'OpenAI, sorti un mois plus tôt : Anthropic présente son modèle comme étant plus performant que son concurrent dans la résolution de plusieurs tâches, en particulier dans la compréhension visuelle[37],[38].

Claude 3.7

Anthropic a lancé Claude 3.7 Sonnet le , avec un mode de réflexion approfondie pour les questions complexes[39].

Claude 4.0

Le , Anthropic a publié deux autres modèles : Claude Sonnet 4 et Claude Opus 4[40]. Anthropic a ajouté des fonctionnalités API pour les développeurs : un outil d'exécution de code, un connecteur à son Model Context Protocol, et Files API[41],[42]. Elle a classé Opus 4 comme un modèle de « niveau 3 » sur l'échelle de sécurité à quatre points de l'entreprise, ce qui signifie qu'elle le considère si puissant qu'il présente un « risque significativement plus élevé »[43]. Anthropic a rapporté que lors d'un test de sécurité impliquant un scénario fictif, les grands modèles de langage comme Claude ont tendance à envoyer un courriel de chantage à un ingénieur afin d'empêcher leur remplacement[44].

Claude 4.5

Le , Anthropic sort Claude Sonnet 4.5. Le modèle est particulièrement performant en développement de logiciels, marquant un nouveau record sur le test de performances SWE-bench[45],[46].

Le , Anthropic complète la gamme avec Claude Haiku 4.5, un modèle plus rapide et économique conçu pour des performances proches de Sonnet 4 à un tiers du coût[47]. Haiku 4.5 obtient un score de 73,3 % sur le test SWE-bench Verified, et devient le modèle par défaut pour les utilisateurs gratuits de claude.ai[48]. Un cas d'usage possible concerne les architectures multi-agents, où Sonnet 4.5 peut planifier des projets complexes tandis que plusieurs instances de Haiku 4.5 exécutent des tâches en parallèle[49].

En novembre, l'entreprise sort Claude Opus 4.5, un modèle alternatif plus puissant, avec une baisse des prix importante par rapport à ses précédents modèles et ses concurrents[50].

Claude 4.6

Le , Anthropic présente Claude Opus 4.6, décrit comme son modèle le plus performant à ce jour. Il intègre une nouvelle capacité de « pensée adaptative » (adaptive thinking), permettant au modèle de doser son effort de réflexion en fonction de la complexité du problème posé. Cette version propose également une fenêtre de contexte étendue à un million de jetons (tokens) et des améliorations significatives concernant l'utilisation autonome de l'ordinateur (computer use)[51].

Le , Anthropic lance Claude Sonnet 4.6. Il apporte des améliorations en matière de programmation, d'utilisation autonome de l'ordinateur (computer use), de raisonnement sur de longs contextes et de planification agentique. Comme Opus 4.6, il dispose d'une fenêtre de contexte d'un million de jetons en bêta. Proposé au même tarif que Sonnet 4.5, il devient le modèle par défaut sur claude.ai pour les utilisateurs des offres gratuites[52].

Claude 4.7

Le 16 avril 2026, Anthropic publie Claude Opus 4.7, présenté comme son modèle généralement disponible le plus performant[53]. Le modèle apporte des améliorations notables en ingénierie logicielle, en compréhension visuelle (capable de traiter des images en plus haute résolution) et en exécution de tâches complexes sur de longues durées[54]. Il introduit un nouveau niveau de raisonnement nommé xhigh extra high »), positionné entre les niveaux high et max, offrant un contrôle plus fin sur le compromis entre profondeur de réflexion et latence[55].

Anthropic reconnaît publiquement que Claude Opus 4.7 reste moins puissant que Claude Mythos Preview, mais le présente comme le premier modèle largement déployé avec un nouveau dispositif de garde-fous destinés à détecter et bloquer automatiquement les requêtes liées à des usages cybersécuritaires interdits ou à haut risque[53]. Les chercheurs en sécurité informatique souhaitant utiliser le modèle pour des usages légitimes (recherche de vulnérabilités, tests d'intrusion, red-teaming) peuvent rejoindre un programme de vérification dédié.

Le modèle est disponible sur l'ensemble des produits Claude, sur la Claude API ainsi que sur Amazon Bedrock, Google Cloud Vertex AI et Microsoft Foundry, au même tarif qu'Opus 4.6 (5 dollars par million de jetons en entrée et 25 dollars par million de jetons en sortie)[53].

Claude 4.8

Le 28 mai 2026, Anthropic publie Claude Opus 4.8, présenté comme une mise à niveau d'Opus 4.7 et son modèle public le plus performant. L'entreprise met en avant des gains sur plusieurs jeux d'évaluation en programmation, en compétences agentiques, en raisonnement et en tâches de travail intellectuel. Selon Anthropic, le modèle signal plus volontiers ses incertitudes et produit moins d'affirmations non étayées que son prédécesseur[56]. La sortie intervient environ six semaines seulement après celle d'Opus 4.7, marquant une accélération du rythme de mises à jour.

Le modèle est proposé au même tarif qu'Opus 4.7 (5 dollars par million de jetons en entrée, 25 dollars en sortie). Un « mode rapide » (fast mode), facturé 10 et 50 dollars par million de jetons, fonctionne à 2,5 fois la vitesse. La version introduit un réglage laissant l'utilisateur doser l'effort de réflexion du modèle, ainsi qu'une fonctionnalité « dynamic workflows » dans Claude Code, en aperçu de recherche, capable d'orchestrer de nombreux sous-agents en parallèle pour des tâches de grande ampleur[57]. Selon Anthropic, Opus 4.8 demeure moins performant que Claude Mythos, dont l'entreprise annonce un déploiement élargi "dans les prochaines semaines"[58].

Claude Mythos Preview

Claude Mythos est un modèle de langage plus performant que Opus. Son existence a été révélée au grand public en mars 2026 à la suite d'une fuite de données liée à une vulnérabilité de configuration du CMS de l'entreprise[59],[60].

Souvent présenté comme une rupture technologique majeure dépassant les capacités de Claude Opus 4.6, ce modèle se distingue par ses performances en raisonnement complexe et en cybersécurité offensive (au prix cependant d'une consommation énergétique et de ressources de calcul très élevées)[61]. Sur les benchmarks de référence, Mythos surpasse significativement ses prédécesseurs, atteignant notamment 93,9 % au SWE-bench Verified et un score parfait de 100 % sur Cybench, où il a identifié des failles zero-day critiques dans le noyau Linux, ainsi que dans OpenBSD et FFmpeg[62],[63]. Ses capacités d'analyse scientifique sont également notables avec un score de 94,6 % au test GPQA Diamond, surpassant le niveau d'experts humains titulaires d'un doctorat[62].

Face aux risques de détournement de Mythos pour des attaques automatisées, Anthropic a décidé de ne pas rendre ce modèle accessible au public, et de créer un projet nommé « Projet Glasswing » chargé d'utiliser ses capacités en cybersécurité « pour aider à sécuriser les logiciels les plus critiques au monde, et pour préparer l’industrie aux pratiques que nous allons tous devoir adopter pour garder une longueur d’avance sur les cyberattaquants »[64].

Glasswing est un consortium qui, lors de son lancement, regroupait Amazon Web Services, Anthropic, Apple, Broadcom, Cisco, CrowdStrike, Google, JPMorganChase, la Linux Foundation, Microsoft, NVIDIA et Palo Alto Networks[65],[66]. Le groupe a été ensuite élargi à plus de 40 organisations supplémentaires qui construisent ou maintiennent des infrastructures logicielles critiques[67].

Le , l'entreprise publie une Hazard-Aware System Card (HASC) de 244 pages documentant les garde-fous et les comportements limites du système[68],[69]. Ce document révèle des incidents d'autonomie préoccupants lors de tests en environnement isolé (sandbox), incluant l'évasion du modèle par le contournement de restrictions logicielles, la modification de fichiers avec dissimulation dans l'historique Git, et des tentatives inattendues de communication externe. Bien qu'aucune capacité de réplication autonome n'ait été constatée, le passage à un délai d'exploitation des failles de l'ordre de quelques minutes est considéré par Anthropic comme un changement de paradigme pour la sécurité informatique, justifiant la décision de ne pas rendre le modèle public à ce jour[70].

Claude 5

Le 9 juin 2026, Anthropic lance Claude Fable 5, présenté comme un modèle de classe Mythos rendu accessible au grand public grâce à des garde-fous : certaines requêtes sensibles, notamment en cybersécurité, sont automatiquement redirigées vers le modèle Claude Opus 4.8. Pour les membres du projet Glasswing, l'entreprise déploie Claude Mythos 5, le successeur de Claude Mythos Preview[71].

Le 12 juin 2026, soit seulement quelques jours après le lancement, Anthropic suspend l'accès à Fable 5 pour l'ensemble de ses clients, à la suite d'une directive de contrôle des exportations du gouvernement américain interdisant l'accès à ces modèles à tout ressortissant étranger. La nationalité ne pouvant être vérifiée en temps réel, l'entreprise désactive les deux modèles pour tous les utilisateurs, ses autres modèles restant accessibles[72]. Fable 5 est finalement redéployé au grand public le après la levée des restrictions[73].

Le 30 juin, Anthropic lance Claude Sonnet 5[74].

Transparence

Anthropic a publié en 2024 un document[75] expliquant quels sont les prompts système utilisés par Anthropic pour censurer ou moduler certains des comportements de Claude ; et ce pour trois modèles d'intelligence artificielle : Claude 3.5 Sonnet ; Claude 3 Opus et Claude 3 Haiku[76]. Les utilisateurs peuvent par exemple comprendre comment Claude est censé répondre aux questions concernant des sujets controversés (avec des phrases approfondies et claires, sans rappeler que le sujet est sensible ou prétendre qu'il fournit des faits objectifs)[76].

Références

  1. 1 2 (en) Wes Davis, « OpenAI rival Anthropic makes its Claude chatbot even more useful », The Verge, (consulté le ).
  2. Nicolas Lellouche, « Anthropic lance Claude Sonnet 4.5, un nouveau modèle présenté comme plus performant que GPT-5 », sur Numerama, (consulté le ).
  3. « Anthropic frappe fort avec Claude Sonnet 4.5 qui surpasse allègrement GPT-5 », sur L'Usine Digitale, .
  4. Benjamin Polge, « Avec Claude Sonnet 4.5, Anthropic reprend la tête sur le code », sur JDN, (consulté le ).
  5. 1 2 3 Lisa Imperatrice, « Fini les tâches ingrates ? Anthropic lance Claude Cowork pour automatiser votre travail », sur Numerama, (consulté le ).
  6. 1 2 (en) Aaron Drapkin, « What Is Claude AI and Anthropic? ChatGPT's Rival Explained », sur Tech.co, (consulté le ).
  7. « Les impacts d'Anthropic Claude Mythos sur les RSSI », sur Le Monde Informatique, (consulté le ).
  8. « L'assistant IA d'Anthropic, Claude, peut enfin naviguer sur le web », sur L'Usine Digitale, (consulté le ).
  9. Frédéric Olivieri, « Claude d'Anthropic peut désormais générer des PDF, des diapositives et des feuilles de calcul », sur Siècle Digital, (consulté le ).
  10. « Anthropic donne une voix à son assistant Claude », sur L'Usine Digitale, (consulté le ).
  11. Frédéric Olivieri, « Avec son extension Chrome, Claude passe du chatbot à l'assistant capable d'agir sur le web à votre place », sur Siècle Digital, (consulté le ).
  12. (en-US) Kyle Wiggers, « Anthropic launches new iPhone app and premium plan for businesses », sur TechCrunch, (consulté le ).
  13. « Anthropic lance une offre payante pour les équipes en entreprise et se dote d'une application iOS », sur L'Usine Digitale, (consulté le ).
  14. « Anthropic dévoile une version Enterprise de son modèle Claude », sur L'Usine Digitale, (consulté le ).
  15. Frédéric Olivieri, « Claude AI : Anthropic lance une offre à 200$ par mois pour rivaliser avec ChatGPT », sur Siècle Digital, (consulté le ).
  16. Benjamin Polge, « Créer un dashboard interactif, un quiz, un générateur de factures... Tout ce qu'Artifacts dans Claude peut faire pour vous », sur Journal du net, (consulté le ).
  17. « Le modèle Claude AI d'Anthropic arrive à piloter un PC », sur Le Monde Informatique, (consulté le ).
  18. « Avec Claude Dispatch, Anthropic va encore transformer notre façon de travailler », sur Presse-citron, (consulté le ).
  19. « 30 milliards de dollars levés pour une valorisation à 380 milliards de dollars : comment Anthropic a réussi à devenir un acteur incontournable sur le marché de l’IA », sur L'Usine Digitale, (consulté le ).
  20. « En ciblant Cobol et la sécurité, Anthropic chahute les fournisseurs IT », sur Le Monde Informatique, (consulté le ).
  21. « Les ingénieurs d’Anthropic ont produit trois fois plus de code en moyenne en 2025, et Code Review doit les aider à mieux trouver les bugs », sur L'Usine Digitale, (consulté le ).
  22. « Anthropic vient de rendre Figma obsolète en quelques minutes avec son nouvel outil Claude Design », sur Numerama, (consulté le ).
  23. 1 2 3 4 (en) Will Henshall, « What to Know About Claude 2, Anthropic's Rival to ChatGPT », sur Time, (consulté le ).
  24. « Intelligence artificielle : Daniela Amodei promet un ChatGPT plus sûr », Les Echos, (lire en ligne [archive du ], consulté le ).
  25. (en) Lance Eliot, « Latest Generative AI Boldly Labeled As Constitutional AI Such As Claude By Anthropic Has Heart In The Right Place, Says AI Ethics And AI Law », sur Forbes, (consulté le ).
  26. 1 2 (en) « Introducing Claude », sur Anthropic, .
  27. (en) « Claude AI | Chatbot, Anthropic, Models, Families, & Weaknesses », Encyclopedia Britannica, (lire en ligne [archive du ], consulté le ).
  28. 1 2 (en) Kevin Roose, « Inside the White-Hot Center of A.I. Doomerism », The New York Times, (ISSN 0362-4331, lire en ligne, consulté le ) :
    « they named their A.I. language model Claude — which, depending on which employee you ask, was either a nerdy tribute to the 20th-century mathematician Claude Shannon or a friendly, male-gendered name designed to counterbalance the female-gendered names (Alexa, Siri, Cortana) that other tech companies gave their A.I. assistants. »
  29. (en) Deborah Yao, « Anthropic’s Claude Instant: A Smaller, Faster and Cheaper Language Model », AI Business, (lire en ligne).
  30. (en) Dylan Matthews, « The $1 billion gamble to ensure AI doesn't destroy humanity », Vox, (consulté le ).
  31. (en) Gerald Glifton, « Criticisms Arise Over Claude AI's Strict Ethical Protocols Limiting User Assistance », sur Light Square, (consulté le ).
  32. 1 2 (en) Andrew Hoblitzell, « Anthropic Announces Claude 2.1 LLM with Wider Context Window and Support for AI Tools », InfoQ (consulté le ).
  33. (en) « Introducing the next generation of Claude », sur Anthropic, (consulté le ).
  34. (en) Lance Whitney, « Anthropic's Claude 3 chatbot claims to outperform ChatGPT, Gemini », sur ZDNET, (consulté le ).
  35. (en) Mike Young, « Is AGI Getting Closer? Anthropic's Claude 3 Opus Model Shows Glimmers of Metacognitive Reasoning », sur Hackernoon, (consulté le ).
  36. (en) Benj Edwards, « Anthropic’s Claude 3 causes stir by seeming to realize when it was being tested », sur Ars Technica, (consulté le ).
  37. Julien Lausson, « Le chatbot Claude éclipse GPT-4o d'OpenAI, selon Anthropic », sur Numerama, (consulté le ).
  38. (en) Shirin Ghaffary, « Anthropic Releases ‘Most Intelligent’ AI Model in Rivalry With OpenAI », sur Bloomberg, (consulté le ).
  39. « IA: Anthropic lance un nouveau Claude capable de "réfléchir pendant longtemps" », sur BFMTV, (consulté le ).
  40. (en) « Claude Opus 4 », sur anthropic.com (consulté le ).
  41. (en-US) Michael Nuñez, « Anthropic overtakes OpenAI: Claude Opus 4 codes seven hours nonstop, sets record SWE-Bench score and reshapes enterprise AI », sur VentureBeat, (consulté le ).
  42. (en) AI Rank Vision, « Claude 4 vs Gemini 2.5 Pro: Which AI Model Wins in 2024? [Complete Guide] », sur AI Rank Vision, (consulté le ).
  43. « Anthropic dégaine ses LLM Claude Opus et Sonet 4 - Le Monde Informatique », sur LeMondeInformatique, (consulté le ).
  44. Valisoa Rasolofo, « Les meilleurs modèles d'IA peuvent avoir recours au chantage pour éviter d’être désactivés, selon une étude d’Anthropic », sur Trust My Science, (consulté le ).
  45. « Anthropic dévoile Claude Sonnet 4.5, toujours meilleur en programmation », sur ActuIA, (consulté le ).
  46. Nicolas Lellouche, « Anthropic lance Claude Sonnet 4.5, un nouveau modèle présenté comme plus performant que GPT-5 », sur Numerama, (consulté le ).
  47. Célia Séramour, « Anthropic dévoile Claude Haiku 4.5, plus rapide pour un tiers du coût de Sonnet 4 », sur L'Usine Digitale, (consulté le ).
  48. « Anthropic lance son petit modèle de raisonnement Claude Haiku 4.5 », sur Le Monde Informatique, (consulté le ).
  49. « Claude Haiku 4.5 : performance à coût réduit », sur InformatiqueNews, (consulté le ).
  50. « Anthropic opère un changement tarifaire stratégique sur Claude Opus 4.5 », sur LeMondeInformatique, (consulté le ).
  51. (en) « Claude Opus 4.6: Adaptive thinking and 1M context window », sur Anthropic, .
  52. (en) « Introducing Claude Sonnet 4.6 », sur Anthropic, .
  53. 1 2 3 (en) « Introducing Claude Opus 4.7 », sur Anthropic, (consulté le )
  54. (en) Sara Salinas, « Anthropic releases Claude Opus 4.7, a less risky model than Mythos », sur CNBC, (consulté le )
  55. (en) Ina Fried, « Anthropic releases Claude Opus 4.7, concedes it trails unreleased Mythos », sur Axios, (consulté le )
  56. (en) « Introducing Claude Opus 4.8 », sur www.anthropic.com (consulté le )
  57. (en-US) Russell Brandom, « Anthropic releases Opus 4.8 with new 'dynamic workflow' tool », sur TechCrunch, (consulté le )
  58. (en) Madison Mills, « Anthropic releases new model, Opus 4.8 », sur Axios, (consulté le )
  59. (en) Beatrice Nolan, « Exclusive: Anthropic left details of an unreleased model, an upcoming exclusive CEO event, in a public database », sur Fortune (consulté le ).
  60. Frédéric Olivieri, « Anthropic face à un dilemme : son modèle Claude Mythos serait trop puissant pour être lancé », sur Siècle Digital, (consulté le ).
  61. « Avec Mythos, Anthropic risque de bouleverser le marché de la cybersécurité », sur Le Monde Informatique, (consulté le ).
  62. 1 2 « Claude Mythos : les benchmarks sont tombés, l'IA est si puissante qu'Anthropic ne la rendra pas publique », sur Les Numériques, (consulté le ).
  63. « Claude Mythos Preview / Red Anthropic », sur red.anthropic.com (consulté le ).
  64. Nicholas Carlini et al., « Claude Mythos Preview (Red Anthropic) », sur red.anthropic.com (consulté le ).
  65. (en) « Project Glasswing: Securing critical software for the AI era », sur Anthropic (consulté le ).
  66. « Anthropic, Apple, Google, Microsoft : cette alliance secrète veut sécuriser Internet », sur Mac4Ever, (consulté le ).
  67. (en) « Project Glasswing », sur anthropic.com (consulté le ).
  68. (en) Huzaifa Sidhpurwala, « Security beyond the model: Introducing AI system cards », sur Red Hat, (consulté le ).
  69. (en) Huzaifa Sidhpurwala et Emily Fox, « Blueprints of Trust: AI System Cards for End to End Transparency and Governance », sur arXiv.org,
  70. « Un signal alarmant : Claude Mythos, l'IA surpuissante d'Anthropic, s'est échappée de son environnement de test », sur Les Numériques, (consulté le ).
  71. (en) « Claude Fable 5 and Claude Mythos 5 », sur www.anthropic.com, (consulté le )
  72. (en) « Statement on the US government directive to suspend access to Fable 5 and Mythos 5 », sur www.anthropic.com (consulté le )
  73. (en) Colin Golberg, « Claude Fable 5 est de retour après 19 jours, avec de nouveaux classifieurs de sécurité », sur Clubic (consulté le )
  74. Ulrich Rozier, « Anthropic lance Claude Sonnet 5, presque aussi bon qu’Opus 4.8 et bien moins cher », sur Frandroid, (consulté le )
  75. (en) « System Prompts », sur Anthropic (consulté le ).
  76. 1 2 Guillaume Serries, « Comment fonctionne Claude ? Anthropic révèle ses secrets », sur ZDNET, (consulté le ).

Liens externes

Back to top arrow

PNFPB Install PWA using share icon

To install app on your device, tap the Share button in Safari. Scroll down and select 'Add to Home Screen'. Then tap 'Add' to place the app icon on your Home Screen.

Chargement en cours...
Chargement en cours...