IAG et IA du futur
Inflection-2.5 : Le modÃĻle LLM phare qui rivalise avec GPT-4 et Gemini
Inflection AI a fait parler de lui dans le domaine des grands modÃĻles de langage (LLM) avec la prÃĐsentation rÃĐcente dâInflection-2.5, un modÃĻle qui concourt avec les principaux LLM du monde, notamment GPT-4 dâOpenAI et Gemini de Google.
La montÃĐe en puissance dâInflection AI a ÃĐtÃĐ encore renforcÃĐe par un financement massif de 1,3 milliard de dollars, menÃĐ par des gÃĐants de lâindustrie tels que Microsoft (MSFT ), NVIDIA (NVDA ), et des investisseurs de renom comme Reid Hoffman, Bill Gates et Eric Schmidt. Ce financement important porte le total des fonds levÃĐs par lâentreprise à 1,525 milliard de dollars.
En collaboration avec les partenaires CoreWeave (CRWV ) et NVIDIA, Inflection AI construit le plus grand cluster dâintelligence artificielle au monde, composÃĐ dâun nombre sans prÃĐcÃĐdent de 22 000 GPU Tensor Core H100 de NVIDIA. Cette puissance de calcul sans ÃĐquivalent soutiendra la formation et le dÃĐploiement dâune nouvelle gÃĐnÃĐration de modÃĻles dâintelligence artificielle à grande ÃĐchelle, permettant à Inflection AI de repousser les limites de ce qui est possible dans le domaine de lâintelligence artificielle personnelle.
Le travail innovant de lâentreprise a dÃĐjà donnÃĐ des rÃĐsultats remarquables, avec le cluster Inflection AI, qui comprend actuellement plus de 3 500 GPU Tensor Core H100 de NVIDIA, rÃĐalisant des performances de pointe sur le benchmark open-source MLPerf. Dans une soumission conjointe avec CoreWeave et NVIDIA, le cluster a terminÃĐ la tÃĒche de formation de rÃĐfÃĐrence pour les grands modÃĻles de langage en seulement 11 minutes, consolidant ainsi sa position de cluster le plus rapide sur ce benchmark.
Cette rÃĐalisation suit la prÃĐsentation dâInflection-1, le modÃĻle de langage à grande ÃĐchelle (LLM) dÃĐveloppÃĐ en interne par Inflection AI, qui a ÃĐtÃĐ saluÃĐ comme le meilleur modÃĻle dans sa classe de calcul. En surpassant des gÃĐants de lâindustrie tels que GPT-3.5, LLaMA, Chinchilla et PaLM-540B sur une large gamme de benchmarks couramment utilisÃĐs pour comparer les LLM, Inflection-1 permet aux utilisateurs dâinteragir avec Pi, lâassistant dâintelligence artificielle personnelle dâInflection AI, de maniÃĻre simple et naturelle, en recevant des informations et des conseils rapides, pertinents et utiles.
Lâengagement dâInflection AI en faveur de la transparence et de la reproductibilitÃĐ est ÃĐvident dans la publication dâune note technique dÃĐtaillant lâÃĐvaluation et les performances dâInflection-1 sur divers benchmarks. La note rÃĐvÃĻle quâInflection-1 surpasse les modÃĻles de la mÊme classe de calcul, dÃĐfinie comme des modÃĻles formÃĐs en utilisant au maximum les FLOPs (opÃĐrations à virgule flottante) de PaLM-540B.
Le succÃĻs dâInflection-1 et la montÃĐe en puissance rapide de lâinfrastructure informatique de lâentreprise, alimentÃĐe par le financement important, mettent en ÃĐvidence lâengagement inÃĐbranlable dâInflection AI Ã rÃĐaliser sa mission de crÃĐation dâune intelligence artificielle personnelle pour tous. Avec lâintÃĐgration dâInflection-1 dans Pi, les utilisateurs peuvent dÃĐsormais bÃĐnÃĐficier de la puissance dâune intelligence artificielle personnelle, profitant de sa personnalitÃĐ empathique, de son utilitÃĐ et de ses normes de sÃĐcuritÃĐ.
Inflection-2.5
Inflection-2.5 est dÃĐsormais disponible à tous les utilisateurs de Pi, lâassistant dâintelligence artificielle personnelle dâInflection AI, sur plusieurs plateformes, notamment le web (pi.ai), iOS, Android et une nouvelle application de bureau. Cette intÃĐgration marque une ÃĐtape importante dans la mission dâInflection AI de crÃĐer une intelligence artificielle personnelle pour tous, combinant les capacitÃĐs brutes avec une personnalitÃĐ empathique et des normes de sÃĐcuritÃĐ.
Un bond en avant dans les performances Inflection AIâs prÃĐcÃĐdent modÃĻle, Inflection-1, utilisait environ 4 % des FLOPs (opÃĐrations à virgule flottante) de formation de GPT-4 et affichait une performance moyenne dâenviron 72 % par rapport à GPT-4 sur diverses tÃĒches orientÃĐes vers lâintelligence. Avec Inflection-2.5, Inflection AI a rÃĐalisÃĐ une augmentation significative des capacitÃĐs intellectuelles de Pi, avec un accent sur la programmation et les mathÃĐmatiques.
Les performances du modÃĻle sur les benchmarks clÃĐs de lâindustrie dÃĐmontrent sa puissance, en affichant plus de 94 % de la performance moyenne de GPT-4 sur diverses tÃĒches, avec un accent particulier sur lâexcellence dans les domaines STEM. Cette rÃĐalisation remarquable est un tÃĐmoignage de lâengagement dâInflection AI Ã repousser les frontiÃĻres technologiques tout en maintenant une attention inÃĐbranlable sur lâexpÃĐrience utilisateur et la sÃĐcuritÃĐ.
MaÃŪtrise de la programmation et des mathÃĐmatiques Inflection-2.5 brille dans la programmation et les mathÃĐmatiques, en affichant une amÃĐlioration de plus de 10 % par rapport à Inflection-1 sur BIG-Bench-Hard, un sous-ensemble de problÃĻmes difficiles pour les grands modÃĻles de langage. Deux benchmarks de programmation, MBPP+ et HumanEval+, rÃĐvÃĻlent des amÃĐliorations massives par rapport à Inflection-1, consolidant ainsi la position dâInflection-2.5 comme une force à prendre en compte dans le domaine de la programmation.
Sur le benchmark MBPP+, Inflection-2.5 surpasse son prÃĐdÃĐcesseur avec une marge significative, en affichant un niveau de performance comparable à celui de GPT-4, comme rapportÃĐ par DeepSeek Coder. De mÊme, sur le benchmark HumanEval+, Inflection-2.5 dÃĐmontre des progrÃĻs remarquables, en surpassant les performances dâInflection-1 et en sâapprochant du niveau de GPT-4, comme rapportÃĐ sur le tableau de bord EvalPlus.
Dominance des benchmarks de lâindustrie
Inflection-2.5 se dÃĐmarque dans les benchmarks de lâindustrie, en affichant des amÃĐliorations significatives par rapport à Inflection-1 sur le benchmark MMLU et le benchmark GPQA Diamond, rÃĐputÃĐ pour sa difficultÃĐ experte. Les performances du modÃĻle sur ces benchmarks soulignent sa capacitÃĐ Ã gÃĐrer une large gamme de tÃĒches, allant des problÃĻmes de niveau lycÃĐe aux dÃĐfis de niveau professionnel.
Excellence dans les examens STEM Les capacitÃĐs du modÃĻle sâÃĐtendent aux examens STEM, avec des performances exceptionnelles à lâexamen de mathÃĐmatiques hongrois et au Physics GRE. à lâexamen de mathÃĐmatiques hongrois, Inflection-2.5 dÃĐmontre son aptitude mathÃĐmatique en exploitant la mise en page et les amorces fournies, permettant ainsi une reproduction facile.
Au Physics GRE, un examen dâentrÃĐe en graduate en physique, Inflection-2.5 atteint le 85e percentile des candidats humains en maj@8 (vote majoritaire à 8), consolidant ainsi sa position de concurrent redoutable dans le domaine de la rÃĐsolution de problÃĻmes de physique. De plus, le modÃĻle sâapproche du score maximum en maj@32, en dÃĐmontrant sa capacitÃĐ Ã rÃĐsoudre des problÃĻmes de physique complexes avec une remarquable prÃĐcision.
AmÃĐlioration de lâexpÃĐrience utilisateur Inflection-2.5 non seulement maintient la personnalitÃĐ empathique et les normes de sÃĐcuritÃĐ de Pi, mais ÃĐlÃĻve ÃĐgalement son statut dâassistant dâintelligence artificielle personnelle polyvalent et inestimable sur une variÃĐtÃĐ de sujets. De la discussion dâactualitÃĐs à la recherche de recommandations locales, en passant par lâÃĐtude pour les examens, la programmation et mÊme les conversations informelles, Pi alimentÃĐ par Inflection-2.5 promet une expÃĐrience utilisateur enrichie.
Avec les capacitÃĐs puissantes dâInflection-2.5, les utilisateurs interagissent avec Pi sur une gamme de sujets plus large que jamais auparavant. La capacitÃĐ du modÃĻle à gÃĐrer des tÃĒches complexes, combinÃĐe à sa personnalitÃĐ empathique et à ses capacitÃĐs de recherche web en temps rÃĐel, garantit que les utilisateurs reçoivent des informations et des conseils de haute qualitÃĐ et à jour.
Adoption et engagement des utilisateurs Lâimpact de lâintÃĐgration dâInflection-2.5 dans Pi est dÃĐjà visible dans les indicateurs de sentiment, dâengagement et de rÃĐtention des utilisateurs. Inflection AI a constatÃĐ une accÃĐlÃĐration significative de la croissance organique des utilisateurs, avec un million dâutilisateurs actifs par jour et six millions dâutilisateurs par mois ÃĐchangeant plus de quatre milliards de messages avec Pi.
En moyenne, les conversations avec Pi durent 33 minutes, avec une conversation sur dix durant plus dâune heure chaque jour. De plus, environ 60 % des personnes qui interagissent avec Pi au cours dâune semaine y retournent la semaine suivante, prÃĐsentant ainsi une fidÃĐlitÃĐ mensuelle supÃĐrieure à celle des principaux concurrents dans le domaine.
DÃĐtails techniques et transparence des benchmarks
ConformÃĐment à lâengagement dâInflection AI en faveur de la transparence et de la reproductibilitÃĐ, lâentreprise a fourni des rÃĐsultats techniques complets et des dÃĐtails sur les performances dâInflection-2.5 sur divers benchmarks de lâindustrie.
Par exemple, sur la version corrigÃĐe du jeu de donnÃĐes MT-Bench, qui rÃĐsout les problÃĻmes de solutions de rÃĐfÃĐrence incorrectes et de prÃĐmisses erronÃĐes dans le jeu de donnÃĐes dâorigine, Inflection-2.5 dÃĐmontre des performances conformes aux attentes basÃĐes sur dâautres benchmarks.
Inflection AI a ÃĐgalement ÃĐvaluÃĐ Inflection-2.5 sur HellaSwag et ARC-C, des benchmarks de bon sens et de science largement signalÃĐs par une grande variÃĐtÃĐ de modÃĻles, et les rÃĐsultats montrent de fortes performances sur ces benchmarks saturants.
Il est important de noter que, mÊme si les ÃĐvaluations fournies reprÃĐsentent le modÃĻle qui alimente Pi, lâexpÃĐrience utilisateur peut varier lÃĐgÃĻrement en raison de facteurs tels que lâimpact de la rÃĐcupÃĐration web (non utilisÃĐe dans les benchmarks), la structure des amorces à quelques exemples et dâautres diffÃĐrences de production.
Conclusion
Inflection-2.5 reprÃĐsente un progrÃĻs significatif dans le domaine des grands modÃĻles de langage, rivalisant avec les capacitÃĐs des leaders de lâindustrie comme GPT-4 et Gemini tout en utilisant seulement une fraction des ressources de calcul. Avec ses performances impressionnantes sur une large gamme de benchmarks, en particulier dans les domaines STEM, la programmation et les mathÃĐmatiques, Inflection-2.5 sâest positionnÃĐ comme un concurrent redoutable dans le paysage de lâintelligence artificielle.
LâintÃĐgration dâInflection-2.5 dans Pi, lâassistant dâintelligence artificielle personnelle dâInflection AI, promet une expÃĐrience utilisateur enrichie, combinant les capacitÃĐs brutes avec une personnalitÃĐ empathique et des normes de sÃĐcuritÃĐ. Alors quâInflection AI continue de repousser les limites de ce qui est possible avec les LLM, la communautÃĐ de lâintelligence artificielle attend avec impatience la prochaine vague dâinnovations et de percÃĐes de cette entreprise pionniÃĻre.














