Brief IA : Bytedance développe un modèle d'IA de dix trillions

Bytedance développe un modèle d'IA de dix trillions

Brief IA
Tom Levy·1 min·16 vues

Bytedance développe un modèle d'IA pouvant atteindre dix trillions de paramètres, le plus grand en Chine, surpassant le Kimi K3 de Moonshot qui en compte trois fois moins. Ce modèle est en phase de préentraînement, une étape qui dure généralement entre trois et six mois, et pourrait positionner Bytedance comme un leader dans le secteur de l'IA en Chine.

En bref
1Bytedance travaille sur un modèle d'IA avec dix trillions de paramètres, le plus grand en Chine.
2Ce modèle surpasse le Kimi K3 de Moonshot, qui est trois fois plus petit.
3Bytedance pourrait transformer le paysage de l'IA avec ce développement ambitieux.
💡Pourquoi c'est importantBytedance pourrait dominer le secteur de l'IA en Chine, influençant la compétitivité technologique mondiale.
Le brief IA que lisent les pros

Tu suis la course aux modèles IA ?

Chaque sortie (GPT, Claude, Gemini, Mistral…) décryptée le soir même, en 5 min. Gratuit.

Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.

Choisis ton rythme

Gratuit · Pas de spam · Désabonnement en 1 clic

📄
L'analyse en français

Bytedance développe un modèle d'IA de dix trillions

Bytedance est en train de former un modèle d'IA pouvant atteindre dix trillions de paramètres, selon le Financial Times. Cela représente trois fois la taille du Kimi K3 de Moonshot, actuellement le plus grand modèle chinois. Cela placerait la société mère de TikTok dans la même catégorie que le système Mythos 5 d'Anthropic, dont les estimations de l'industrie évaluent la taille à environ huit trillions de paramètres. Anthropic n'a pas divulgué ses propres chiffres.

Trois sources internes ont indiqué au FT que le modèle est en phase de préentraînement, une étape qui prend généralement entre trois et six mois. Les paramètres déterminent la quantité d'informations qu'un modèle peut stocker, mais la performance dépend également de la qualité des données et des méthodes d'entraînement. L'une des sources a mentionné que Bytedance a évité la distillation, c'est-à-dire l'entraînement sur les sorties des modèles d'autres entreprises, pendant plus d'un an.

Le fondateur Zhang Yiming a demandé à l'équipe Seed de 2 000 personnes de viser des capacités de modèle de classe mondiale à long terme. xAI est également en train de former des variantes de Grok avec six et dix trillions de paramètres sur son cluster Colossus 2, selon Elon Musk.

Suivez Brief IA

L'actu IA du jour, aussi dans votre fil.

Commentaires