← Inicio

ByteDance entrena un modelo masivo de IA para rivalizar con Anthropic

ByteDance, la matriz de TikTok, está entrenando un modelo de hasta 10 billones de parámetros — una escala que la coloca a la altura de Anthropic y de su sistema más avanzado, Mythos. La noticia, del Financial Times y recogida por Ars Technica, no es solo un hito de tamaño: es una declaración de ambición, la señal de que el mayor grupo tecnológico chino ha decidido disputar la frontera absoluta del sector.

Las cifras ayudan a dimensionar la apuesta. Según tres personas con conocimiento del proyecto, el modelo está en fase de preentrenamiento, una etapa que suele durar de tres a seis meses; el tamaño exacto se decidirá antes de un eventual ajuste y del lanzamiento. Los 10 billones de parámetros suponen más del triple del tamaño del Kimi K3, de Moonshot, el mayor modelo chino publicado hasta la fecha, con unos 2,8 billones. Anthropic no revela las dimensiones de sus sistemas, pero las estimaciones del sector sitúan al Mythos 5 en torno a los 8 billones de parámetros y al Fable 5 en unos 5 billones. Aun así, los parámetros no equivalen a capacidad: la calidad de los datos pesa tanto como el tamaño.

El contexto geopolítico hace la decisión aún más cargada. Durante años, los laboratorios chinos se ganaron una reputación basada en la eficiencia: DeepSeek demostró que es posible competir con modelos más pequeños y menos costosos, mientras que Qwen, de Alibaba, y Kimi, de Moonshot, rinden bien en los benchmarks y solo quedan por detrás del Fable 5 en algunas tareas. ByteDance, sin embargo, elige el camino contrario: el de la escala máxima, cuando la industria estadounidense lidera por el coste computacional y los chips avanzados. Es la apuesta a que, para superar a Anthropic, hará falta ir más allá de la eficiencia e invertir en puro poder de cómputo.

La empresa tiene ventajas concretas. En los últimos tres años ha invertido en IA con más agresividad que cualquier otro gigante chino, ha construido centros de datos y aspira a sus propios chips. Su equipo Seed, dirigido por el antiguo científico de Google DeepMind Wu Yonghui, reúne a unas 2.000 personas. El asistente Doubao es el producto de IA más popular de China, con 324 millones de usuarios, y SeeDance figura entre los más avanzados del mundo en generación de vídeo. Lo que le falta es un modelo de frontera que compita en lo más alto con los laboratorios estadounidenses.

Hay además una dimensión estratégica fundamental. ByteDance adoptó el desarrollo independiente desde hace más de un año, rechazando destilar modelos de otros laboratorios — método habitual de compresión del conocimiento que muchos rivales usaron para avanzar más rápido. Zhang Yiming, fundador, habría dicho a su equipo, en una reciente reunión interna, que solo el desarrollo independiente puede generar un modelo que supere a los competidores, y pidió apuntar a "capacidades de nivel mundial" sin preocuparse por el retraso a corto plazo. Esa decisión explica por qué la empresa ha sido vista como más lenta que algunos rivales, pero también la posiciona para un liderazgo sostenido.

La pregunta que queda abierta es si el coste de cómputo — y las restricciones a la exportación de chips — permitirá que el plan se materialice. Con modelos cerrados, ByteDance se enfrenta al mismo techo geopolítico que el resto de laboratorios chinos. Si consigue un modelo de 10 billones de parámetros con calidad comparable a Mythos, el equilibrio de fuerzas de la IA mundial cambiará. Si fracasa, será la demostración más cara hasta ahora de que la escala no es destino.

Fuentes: Ars Technica, The Next Web, Techloy, Mint

✓ Fuentes independientes cruzadas y verificadas antes de la publicación