IAG et IA du futur

Inflection-2.5 : Le modÃĻle LLM phare qui rivalise avec GPT-4 et Gemini

mm
Ajouter Unite.AI à vos sources prÃĐfÃĐrÃĐes sur Google

Inflection AI a fait parler de lui dans le domaine des grands modÃĻles de langage (LLM) avec la prÃĐsentation rÃĐcente d’Inflection-2.5, un modÃĻle qui concourt avec les principaux LLM du monde, notamment GPT-4 d’OpenAI et Gemini de Google.

La montÃĐe en puissance d’Inflection AI a ÃĐtÃĐ encore renforcÃĐe par un financement massif de 1,3 milliard de dollars, menÃĐ par des gÃĐants de l’industrie tels que Microsoft (MSFT ), NVIDIA (NVDA ), et des investisseurs de renom comme Reid Hoffman, Bill Gates et Eric Schmidt. Ce financement important porte le total des fonds levÃĐs par l’entreprise à 1,525 milliard de dollars.

En collaboration avec les partenaires CoreWeave (CRWV ) et NVIDIA, Inflection AI construit le plus grand cluster d’intelligence artificielle au monde, composÃĐ d’un nombre sans prÃĐcÃĐdent de 22 000 GPU Tensor Core H100 de NVIDIA. Cette puissance de calcul sans ÃĐquivalent soutiendra la formation et le dÃĐploiement d’une nouvelle gÃĐnÃĐration de modÃĻles d’intelligence artificielle à grande ÃĐchelle, permettant à Inflection AI de repousser les limites de ce qui est possible dans le domaine de l’intelligence artificielle personnelle.

Le travail innovant de l’entreprise a dÃĐjà donnÃĐ des rÃĐsultats remarquables, avec le cluster Inflection AI, qui comprend actuellement plus de 3 500 GPU Tensor Core H100 de NVIDIA, rÃĐalisant des performances de pointe sur le benchmark open-source MLPerf. Dans une soumission conjointe avec CoreWeave et NVIDIA, le cluster a terminÃĐ la tÃĒche de formation de rÃĐfÃĐrence pour les grands modÃĻles de langage en seulement 11 minutes, consolidant ainsi sa position de cluster le plus rapide sur ce benchmark.

Cette rÃĐalisation suit la prÃĐsentation d’Inflection-1, le modÃĻle de langage à grande ÃĐchelle (LLM) dÃĐveloppÃĐ en interne par Inflection AI, qui a ÃĐtÃĐ saluÃĐ comme le meilleur modÃĻle dans sa classe de calcul. En surpassant des gÃĐants de l’industrie tels que GPT-3.5, LLaMA, Chinchilla et PaLM-540B sur une large gamme de benchmarks couramment utilisÃĐs pour comparer les LLM, Inflection-1 permet aux utilisateurs d’interagir avec Pi, l’assistant d’intelligence artificielle personnelle d’Inflection AI, de maniÃĻre simple et naturelle, en recevant des informations et des conseils rapides, pertinents et utiles.

L’engagement d’Inflection AI en faveur de la transparence et de la reproductibilitÃĐ est ÃĐvident dans la publication d’une note technique dÃĐtaillant l’ÃĐvaluation et les performances d’Inflection-1 sur divers benchmarks. La note rÃĐvÃĻle qu’Inflection-1 surpasse les modÃĻles de la mÊme classe de calcul, dÃĐfinie comme des modÃĻles formÃĐs en utilisant au maximum les FLOPs (opÃĐrations à virgule flottante) de PaLM-540B.

Le succÃĻs d’Inflection-1 et la montÃĐe en puissance rapide de l’infrastructure informatique de l’entreprise, alimentÃĐe par le financement important, mettent en ÃĐvidence l’engagement inÃĐbranlable d’Inflection AI à rÃĐaliser sa mission de crÃĐation d’une intelligence artificielle personnelle pour tous. Avec l’intÃĐgration d’Inflection-1 dans Pi, les utilisateurs peuvent dÃĐsormais bÃĐnÃĐficier de la puissance d’une intelligence artificielle personnelle, profitant de sa personnalitÃĐ empathique, de son utilitÃĐ et de ses normes de sÃĐcuritÃĐ.

Inflection-2.5

Inflection-2.5 est dÃĐsormais disponible à tous les utilisateurs de Pi, l’assistant d’intelligence artificielle personnelle d’Inflection AI, sur plusieurs plateformes, notamment le web (pi.ai), iOS, Android et une nouvelle application de bureau. Cette intÃĐgration marque une ÃĐtape importante dans la mission d’Inflection AI de crÃĐer une intelligence artificielle personnelle pour tous, combinant les capacitÃĐs brutes avec une personnalitÃĐ empathique et des normes de sÃĐcuritÃĐ.

Un bond en avant dans les performances Inflection AI’s prÃĐcÃĐdent modÃĻle, Inflection-1, utilisait environ 4 % des FLOPs (opÃĐrations à virgule flottante) de formation de GPT-4 et affichait une performance moyenne d’environ 72 % par rapport à GPT-4 sur diverses tÃĒches orientÃĐes vers l’intelligence. Avec Inflection-2.5, Inflection AI a rÃĐalisÃĐ une augmentation significative des capacitÃĐs intellectuelles de Pi, avec un accent sur la programmation et les mathÃĐmatiques.

Les performances du modÃĻle sur les benchmarks clÃĐs de l’industrie dÃĐmontrent sa puissance, en affichant plus de 94 % de la performance moyenne de GPT-4 sur diverses tÃĒches, avec un accent particulier sur l’excellence dans les domaines STEM. Cette rÃĐalisation remarquable est un tÃĐmoignage de l’engagement d’Inflection AI à repousser les frontiÃĻres technologiques tout en maintenant une attention inÃĐbranlable sur l’expÃĐrience utilisateur et la sÃĐcuritÃĐ.

MaÃŪtrise de la programmation et des mathÃĐmatiques Inflection-2.5 brille dans la programmation et les mathÃĐmatiques, en affichant une amÃĐlioration de plus de 10 % par rapport à Inflection-1 sur BIG-Bench-Hard, un sous-ensemble de problÃĻmes difficiles pour les grands modÃĻles de langage. Deux benchmarks de programmation, MBPP+ et HumanEval+, rÃĐvÃĻlent des amÃĐliorations massives par rapport à Inflection-1, consolidant ainsi la position d’Inflection-2.5 comme une force à prendre en compte dans le domaine de la programmation.

Sur le benchmark MBPP+, Inflection-2.5 surpasse son prÃĐdÃĐcesseur avec une marge significative, en affichant un niveau de performance comparable à celui de GPT-4, comme rapportÃĐ par DeepSeek Coder. De mÊme, sur le benchmark HumanEval+, Inflection-2.5 dÃĐmontre des progrÃĻs remarquables, en surpassant les performances d’Inflection-1 et en s’approchant du niveau de GPT-4, comme rapportÃĐ sur le tableau de bord EvalPlus.

Dominance des benchmarks de l’industrie

Inflection-2.5 se dÃĐmarque dans les benchmarks de l’industrie, en affichant des amÃĐliorations significatives par rapport à Inflection-1 sur le benchmark MMLU et le benchmark GPQA Diamond, rÃĐputÃĐ pour sa difficultÃĐ experte. Les performances du modÃĻle sur ces benchmarks soulignent sa capacitÃĐ Ã  gÃĐrer une large gamme de tÃĒches, allant des problÃĻmes de niveau lycÃĐe aux dÃĐfis de niveau professionnel.

Excellence dans les examens STEM Les capacitÃĐs du modÃĻle s’ÃĐtendent aux examens STEM, avec des performances exceptionnelles à l’examen de mathÃĐmatiques hongrois et au Physics GRE. À l’examen de mathÃĐmatiques hongrois, Inflection-2.5 dÃĐmontre son aptitude mathÃĐmatique en exploitant la mise en page et les amorces fournies, permettant ainsi une reproduction facile.

Au Physics GRE, un examen d’entrÃĐe en graduate en physique, Inflection-2.5 atteint le 85e percentile des candidats humains en maj@8 (vote majoritaire à 8), consolidant ainsi sa position de concurrent redoutable dans le domaine de la rÃĐsolution de problÃĻmes de physique. De plus, le modÃĻle s’approche du score maximum en maj@32, en dÃĐmontrant sa capacitÃĐ Ã  rÃĐsoudre des problÃĻmes de physique complexes avec une remarquable prÃĐcision.

AmÃĐlioration de l’expÃĐrience utilisateur Inflection-2.5 non seulement maintient la personnalitÃĐ empathique et les normes de sÃĐcuritÃĐ de Pi, mais ÃĐlÃĻve ÃĐgalement son statut d’assistant d’intelligence artificielle personnelle polyvalent et inestimable sur une variÃĐtÃĐ de sujets. De la discussion d’actualitÃĐs à la recherche de recommandations locales, en passant par l’ÃĐtude pour les examens, la programmation et mÊme les conversations informelles, Pi alimentÃĐ par Inflection-2.5 promet une expÃĐrience utilisateur enrichie.

Avec les capacitÃĐs puissantes d’Inflection-2.5, les utilisateurs interagissent avec Pi sur une gamme de sujets plus large que jamais auparavant. La capacitÃĐ du modÃĻle à gÃĐrer des tÃĒches complexes, combinÃĐe à sa personnalitÃĐ empathique et à ses capacitÃĐs de recherche web en temps rÃĐel, garantit que les utilisateurs reçoivent des informations et des conseils de haute qualitÃĐ et à jour.

Adoption et engagement des utilisateurs L’impact de l’intÃĐgration d’Inflection-2.5 dans Pi est dÃĐjà visible dans les indicateurs de sentiment, d’engagement et de rÃĐtention des utilisateurs. Inflection AI a constatÃĐ une accÃĐlÃĐration significative de la croissance organique des utilisateurs, avec un million d’utilisateurs actifs par jour et six millions d’utilisateurs par mois ÃĐchangeant plus de quatre milliards de messages avec Pi.

En moyenne, les conversations avec Pi durent 33 minutes, avec une conversation sur dix durant plus d’une heure chaque jour. De plus, environ 60 % des personnes qui interagissent avec Pi au cours d’une semaine y retournent la semaine suivante, prÃĐsentant ainsi une fidÃĐlitÃĐ mensuelle supÃĐrieure à celle des principaux concurrents dans le domaine.

DÃĐtails techniques et transparence des benchmarks

ConformÃĐment à l’engagement d’Inflection AI en faveur de la transparence et de la reproductibilitÃĐ, l’entreprise a fourni des rÃĐsultats techniques complets et des dÃĐtails sur les performances d’Inflection-2.5 sur divers benchmarks de l’industrie.

Par exemple, sur la version corrigÃĐe du jeu de donnÃĐes MT-Bench, qui rÃĐsout les problÃĻmes de solutions de rÃĐfÃĐrence incorrectes et de prÃĐmisses erronÃĐes dans le jeu de donnÃĐes d’origine, Inflection-2.5 dÃĐmontre des performances conformes aux attentes basÃĐes sur d’autres benchmarks.

Inflection AI a ÃĐgalement ÃĐvaluÃĐ Inflection-2.5 sur HellaSwag et ARC-C, des benchmarks de bon sens et de science largement signalÃĐs par une grande variÃĐtÃĐ de modÃĻles, et les rÃĐsultats montrent de fortes performances sur ces benchmarks saturants.

Il est important de noter que, mÊme si les ÃĐvaluations fournies reprÃĐsentent le modÃĻle qui alimente Pi, l’expÃĐrience utilisateur peut varier lÃĐgÃĻrement en raison de facteurs tels que l’impact de la rÃĐcupÃĐration web (non utilisÃĐe dans les benchmarks), la structure des amorces à quelques exemples et d’autres diffÃĐrences de production.

Conclusion

Inflection-2.5 reprÃĐsente un progrÃĻs significatif dans le domaine des grands modÃĻles de langage, rivalisant avec les capacitÃĐs des leaders de l’industrie comme GPT-4 et Gemini tout en utilisant seulement une fraction des ressources de calcul. Avec ses performances impressionnantes sur une large gamme de benchmarks, en particulier dans les domaines STEM, la programmation et les mathÃĐmatiques, Inflection-2.5 s’est positionnÃĐ comme un concurrent redoutable dans le paysage de l’intelligence artificielle.

L’intÃĐgration d’Inflection-2.5 dans Pi, l’assistant d’intelligence artificielle personnelle d’Inflection AI, promet une expÃĐrience utilisateur enrichie, combinant les capacitÃĐs brutes avec une personnalitÃĐ empathique et des normes de sÃĐcuritÃĐ. Alors qu’Inflection AI continue de repousser les limites de ce qui est possible avec les LLM, la communautÃĐ de l’intelligence artificielle attend avec impatience la prochaine vague d’innovations et de percÃĐes de cette entreprise pionniÃĻre.

L’approche visionnaire d’Inflection AI s’ÃĐtend au-delà du simple dÃĐveloppement de modÃĻles, car l’entreprise reconnaÃŪt l’importance de la prÃĐ-formation et de la fine-tune pour crÃĐer des expÃĐriences d’intelligence artificielle de haute qualitÃĐ, sÃŧres et utiles. En tant qu’atelier d’intelligence artificielle verticalement intÃĐgrÃĐ, Inflection AI gÃĻre l’ensemble du processus en interne, de l’ingestion des donnÃĐes à la conception de modÃĻles et à l’infrastructure haute performance.

J'ai passÃĐ les cinq derniÃĻres annÃĐes à plonger dans le monde fascinant de l'apprentissage automatique et du deep learning. Ma passion et mon expertise m'ont conduit à contribuer à plus de 50 projets de gÃĐnie logiciel divers, avec un focus particulier sur l'IA/ML. Ma curiositÃĐ continue m'a ÃĐgalement attirÃĐ vers le traitement automatique des langues, un domaine que je suis impatient d'explorer plus en profondeur.