


























DeepSeek acelera en la carrera por dominar la inteligencia artificial y lanza dos versiones de su nuevo modelo de IA el V4. Y lo hace justo un año después de asombrar al mundo y a Silicon Valley. Según la propia compañía, este modelo de código abierto es más potente que el de competidores como OpenAI o Anthropic.
La startup china presentó dos versiones de su modelo V4, el V4 Flash y el V4 Pro, destacando su rendimiento superior en pruebas de codificación y grandes avances en razonamiento y tareas de agentes. Según informó la startup en Hugging Face, estas series incorporan mejoras de arquitectura y optimización. DeepSeek resaltó una técnica denominada Arquitectura de Atención Híbrida, que, según la compañía, mejora la capacidad de una plataforma de IA para recordar consultas durante conversaciones extensas. Además, impulsó la ventana de contexto de un millón de tokens, un avance que permite enviar bases de código completas o documentos extensos como una sola solicitud.
El V4 llega más de un año después de que la startup con sede en Hangzhou provocara una caída bursátil de un billón de dólares con el lanzamiento del R1, un modelo de código abierto que imita el proceso de razonamiento humano. El R1 rivalizaba con el rendimiento de sistemas de IA de vanguardia de empresas como OpenAI, pero supuestamente se construyó a una fracción del costo.
Las acciones de los fabricantes de chips chinos repuntaron el viernes, ya que los inversores apostaron a que el nuevo modelo impulsará la demanda de chips locales. En una publicación en redes sociales, DeepSeek indicó que la capacidad de servicio de la serie V4 Pro es extremadamente limitada debido a la escasez de recursos informáticos. Sin embargo, la startup prevé que el precio del modelo disminuya significativamente tras el lanzamiento de los clústeres de computación equipados con los chips Ascend 950 de Huawei en la segunda mitad de este año. DeepSeek se encuentra actualmente en conversaciones con Tencent y Alibaba para su primera ronda de financiación.
Las acciones de Semiconductor Manufacturing International, el principal fabricante de chips de Huawei, subieron hasta un 9,4% en Hong Kong, mientras que las de Hua Hong Semiconductor se dispararon más de un 13%. Sus rivales, como Knowledge Atlas Technology JSC Ltd. (o Zhipu), cayeron un 8%.
La nueva serie representa un gran avance en la escala y la eficiencia que han caracterizado el ascenso de DeepSeek y han ejercido una enorme presión competitiva sobre sus rivales. Tras el lanzamiento del R1, las empresas tecnológicas y los inversores comenzaron a replantearse la conveniencia de invertir miles de millones de dólares en el desarrollo de la IA. Sin embargo, esas inversiones se han recuperado, ya que se prevé que los gigantes tecnológicos estadounidenses inviertan alrededor de 650.000 millones de dólares en 2026 en infraestructura y centros de datos para IA.
El sistema de un billón de parámetros de DeepSeek utiliza la técnica de mezcla de expertos, que activa selectivamente solo un pequeño subconjunto de expertos y solo hasta 37 mil millones de parámetros por tarea para mantener los costos de inferencia mucho más bajos que para modelos de frontera similares.
La arquitectura y las técnicas empleadas posicionan a DeepSeek directamente frente a sus competidores de Silicon Valley, OpenAI, Google y los últimos modelos de Anthropic. El viernes, la startup destacó su rendimiento superior al de GPT-5.2 de OpenAI en pruebas de referencia estándar, pero reconoció que la versión 4 está entre 3 y 6 meses por detrás de los modelos de última generación.
Sin embargo, DeepSeek ha recalcado que no se centra únicamente en potencia bruta, sino también en reducir fundamentalmente los costes. El V4 está diseñado para implementarse en infraestructuras más económicas. "Minimax y Zhipu, como proveedores de modelos independientes, siempre serán vulnerables a la competencia, especialmente de las plataformas de internet o los proveedores de servicios en la nube, que tienen mayor alcance y distribución", afirmó Vey-Sern Ling, director general de Union Bancaire Privee. "Con el tiempo, la diferencia en el rendimiento de los modelos será imperceptible para la mayoría de los usuarios".
DeepSeek también causó furor en China, donde líderes tecnológicos como Alibaba y Baidu inundaron el mercado con servicios de IA de bajo costo. Competidores como ByteDance, Zhipu y Minimax se apresuraron a actualizar sus modelos en las semanas previas a abril, con la esperanza de aventajar a DeepSeek.
Con la fama también llegó el escrutinio. Líderes tecnológicos y funcionarios gubernamentales estadounidenses han acusado a DeepSeek de utilizar técnicas y hardware ilícitos para desarrollar sus modelos.
Uno de los aspectos clave es la denominada destilación, mediante la cual un modelo de IA se basa en la salida de otro para su entrenamiento y así desarrollar capacidades similares. Tanto OpenAI como Anthropic han afirmado haber detectado este tipo de ataques por parte de DeepSeek, una preocupación que OpenAI comenzó a plantear en privado poco después del lanzamiento del modelo R1.
La otra preocupación es que DeepSeek pueda tener acceso a chips de IA de Nvidia que están prohibidos, una posibilidad que los funcionarios estadounidenses comenzaron a investigar el año pasado.
Según fuentes familiarizadas con el asunto, el gobierno estadounidense cree que la empresa emergente china utilizó procesadores Nvidia Blackwell, cuya venta a China está prohibida, en un centro de datos en Mongolia Interior.
此内容由惯性聚合(RSS阅读器)自动聚合整理,仅供阅读参考。 原文来自 — 版权归原作者所有。