Brief IA : Infinity attire 15 millions de dollars avec OpenAI et Anthropic

Infinity attire 15 millions de dollars avec OpenAI et Anthropic

Brief IA
Tom Levy·4 min·4 vues

Infinity, spécialisée en infrastructure IA, a levé 15 millions de dollars, atteignant une valorisation de 100 millions de dollars. Ce financement provient de Touring Capital, Principal VC, ainsi que de chercheurs d'OpenAI et Anthropic, soulignant l'intérêt des investisseurs pour les startups d'inférence IA.

En bref
1Infinity, spécialisée en infrastructure IA, a levé 15 millions de dollars, atteignant une valorisation de 100 millions de dollars.
2Le financement provient de Touring Capital, Principal VC, et de chercheurs d'OpenAI et Anthropic.
3Cette levée de fonds souligne l'intérêt des investisseurs pour les startups d'inférence IA.
💡Pourquoi c'est importantCette levée de fonds renforce la position d'Infinity dans le domaine de l'infrastructure IA, soutenue par des acteurs majeurs de l'industrie.
Le brief IA que lisent les pros

L’IA qui transforme le business ?

Stratégies, mouvements et levées IA décryptés, chaque soir en 5 min. Gratuit.

Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.

Choisis ton rythme

Gratuit · Pas de spam · Désabonnement en 1 clic

📄
L'analyse en français

Infinity attire 15 millions de dollars avec OpenAI et Anthropic

La société d'infrastructure IA Infinity a annoncé une levée de fonds de 15 millions de dollars à une valorisation de 100 millions de dollars lundi, provenant d'investisseurs tels que Touring Capital, Principal VC, ainsi que de chercheurs d'entreprises comme OpenAI et Anthropic. La startup développe un logiciel visant à faciliter l'exécution de modèles IA sur des puces IA. Une des raisons majeures pour lesquelles Nvidia est devenu le leader du marché n'est pas seulement la performance de ses puces, mais aussi son logiciel CUDA (Compute Unified Device Architecture), qui permet à ses GPU (initialement conçus pour le graphisme) de fonctionner comme des CPU à usage général. Les principaux frameworks de développement IA, PyTorch et TensorFlow, ont été construits sur CUDA. Cela permet aux développeurs d'écrire leurs applications dans des langages populaires comme Python, d'utiliser ces frameworks majeurs, et leurs applications fonctionneront par défaut sur les puces Nvidia.

La plupart de ces startups au niveau des applications n'auraient pas les ressources ou le savoir-faire nécessaires pour écrire leurs propres kernels — le logiciel de bas niveau qui fait fonctionner les puces — et porter leurs applications sur d'autres puces IA. Ainsi, Infinity tente de créer un logiciel de kernel alternatif à CUDA qui fonctionne avec tout type de puce, comme les SRAM, les GPU, les puces de téléphone et les Systolic Arrays. Infinity fait partie d'une nouvelle vague de startups qui s'efforcent, produit par produit, de réduire la domination de Nvidia sur le marché.

Infinity cherche à construire une bibliothèque d'inférence universelle pour fonctionner sur toutes les puces, permettant à ces puces d'automatiser la réplication des résultats de recherche à la pointe de la technologie.

Infinity a été fondée l'année dernière par Jeremy Nixon, ancien chercheur chez Google Brain et créateur de la communauté de réseau de hackers AGI House. Nixon a déclaré à TechCrunch qu'il avait décidé de lancer cette entreprise parce qu'il était obsédé par l'idée de "l'invention automatisée" — la conviction que "les systèmes IA peuvent en fait être une méta technologie." Il a lui-même inventé un algorithme d'apprentissage automatique appelé Omega, qui créait essentiellement de nouveaux algorithmes d'apprentissage automatique et les évaluait automatiquement dans une boucle de rétroaction.

Ce succès l'a amené à réfléchir à d'autres cas où cette approche pourrait fonctionner, et il s'est tourné vers le matériel, croyant que des systèmes automatisés pourraient également générer le code de bas niveau, comme les kernels et autres, nécessaires pour faire fonctionner les puces de manière plus efficace.

L'agent de recherche IA d'Infinity, Ignition, est destiné à écrire le code de bas niveau nécessaire pour l'inférence IA sur des puces alternatives à Nvidia. Il teste, débogue et mesure la rapidité de performance du matériel avec le code, et réécrit automatiquement le code si nécessaire pour améliorer les performances. Le système est auto-optimisant, ce qui signifie qu'il apprend et s'améliore en continu. Il s'adapte également à différentes architectures de puces, indépendamment des conceptions propriétaires, selon Nixon. Le résultat est ce qu'Infinity affirme être une pile logicielle de niveau CUDA.

Parmi les clients se trouve le fabricant de puces IA (et futur concurrent de Nvidia) D-Matrix, et Infinity est en pourparlers avec d'autres grandes entreprises de puces et de cloud, a déclaré Nixon.

Cependant, les humains restent impliqués, fournissant une direction de haut niveau tandis que l'agent s'occupe de la plupart des tâches fastidieuses. Dans une étude de cas, la startup a constaté que l'agent travaillait beaucoup plus rapidement qu'un humain seul, réduisant ce qui aurait pu être un processus de plusieurs années ou mois à quelques heures ou jours. Infinity ne facture pas de frais de licence initiaux ; au lieu de cela, elle prend une part des gains de performance et des économies de coûts, mesurant les changements en tokens par seconde.

Actuellement, Infinity compte 26 employés, y compris ceux dans le design, les opérations et l'ingénierie.

Suivez Brief IA

L'actu IA du jour, aussi dans votre fil.

Commentaires