惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
人人都是产品经理
人人都是产品经理
爱范儿
爱范儿
aimingoo的专栏
aimingoo的专栏
博客园 - 叶小钗
H
Help Net Security
Microsoft Security Blog
Microsoft Security Blog
The Cloudflare Blog
S
SegmentFault 最新的问题
小众软件
小众软件
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
博客园 - 司徒正美
The GitHub Blog
The GitHub Blog
量子位
H
Hackread – Cybersecurity News, Data Breaches, AI and More
V
V2EX
Martin Fowler
Martin Fowler
博客园 - 【当耐特】
J
Java Code Geeks
D
DataBreaches.Net
云风的 BLOG
云风的 BLOG
F
Fortinet All Blogs
Blog — PlanetScale
Blog — PlanetScale
Last Week in AI
Last Week in AI

Business Insider - Lo último

Trump afirma que la Armada estadounidense comenzará el bloqueo del Estrecho de Ormuz "con efecto inmediato" Estados Unidos e Irán no logran alcanzar un acuerdo de paz tras las primeras negociaciones La fiebre inversora ultra-alcista de la IA ignora a Irán pero hay un elevado riesgo de decepción La IA coloniza la recomendación en las plataformas: el caso de Spotify y los podcasts Armamento, drones, edificios o alimentos, así están utilizando los ejércitos la impresión 3D El misterio de Khaby Lame: el principal creador de TikTok anunció un acuerdo de 975 millones de dólares y luego guardó silencio OpenAI acusa a Elon Musk de "emboscada" a las puertas de un juicio de más de 100.000 millones de dólares Fotos históricas de la Mision Artemis II de la NASA y el vuelo de la nave Orion a la Luna La IA Mythos de Anthropic preocupa: "En malas manos, es un problema serio" Duelo de titanes en Wall Street: SpaceX, OpenAI y Anthropic pondrán a prueba al mercado Las sombras de Bitcoin: del oscuro Satoshi Nakamoto a la vulnerabilidad Claude Mythos Amazon crea el 'Proyecto Houdini' para hacer desaparecer los retrasos en los centros de datos El científico jefe de OpenAI aventura que la IA se acerca a ser tan buena como un becario de investigación Google lanza el entrenador personal de Fitbit con inteligencia artificial en España y otros 36 países Salario de un programador junior en España: guía 2026 Momento clave para los funcionarios con el inicio de la reducción de jornada: así será la semana de 35 horas para los funcionarios China convierte la inteligencia artificial en asignatura obligatoria desde primaria Ucrania aumenta el uso de vehículos terrestres no tripulados en combate: 24.500 misiones desde enero Los funcionarios de Hacienda en pie de guerra por sus salarios y jornada Cómo hacer la declaración de la Renta como un profesional: las claves de los técnicos de Hacienda Miedo a la IA: el sector del software se desploma otra vez tras las novedades de Anthropic y Meta El inversor de "La gran apuesta" pronostica que Anthropic desbancará a Palantir Rutte afirma que la OTAN podría colaborar en una misión en el estrecho de Ormuz "si es útil" Cómo Starlink ayuda a Irán a evitar el bloqueo de internet durante la guerra El plan militar de Francia: aumentar el gasto en 36.000 millones con la mirada puesta en los drones El Gobierno pagará el IMV a mayores de 23 años que viven con sus padres, solo si cobran menos de esta cantidad xAI reorganiza su equipo de ingeniería antes de la salida a bolsa de Space X Operaciones especiales del Ejército del Aire (Ezapac) moderniza su armamento con una nueva pistola El ciberataque como arma silenciosa durante los conflictos globales: todo el mundo está en peligro Una empresa de EEUU usa impresión 3D con IA para producir embarcaciones militares no tripuladas
DeepSeek presenta V4, un nuevo modelo de IA de código abi...
Lidia Sánche · 2026-04-24 · via Business Insider - Lo último

DeepSeek acelera en la carrera por dominar la inteligencia artificial y lanza dos versiones de su nuevo modelo de IA el V4. Y lo hace justo un año después de asombrar al mundo y a Silicon Valley. Según la propia compañía, este modelo de código abierto es más potente que el de competidores como OpenAI o Anthropic.

La startup china presentó dos versiones de su modelo V4, el V4 Flash y el V4 Pro, destacando su rendimiento superior en pruebas de codificación y grandes avances en razonamiento y tareas de agentes. Según informó la startup en Hugging Face, estas series incorporan mejoras de arquitectura y optimización. DeepSeek resaltó una técnica denominada Arquitectura de Atención Híbrida, que, según la compañía, mejora la capacidad de una plataforma de IA para recordar consultas durante conversaciones extensas. Además, impulsó la ventana de contexto de un millón de tokens, un avance que permite enviar bases de código completas o documentos extensos como una sola solicitud.

DeepSeek revolucionó Silicon valley hace un año

El V4 llega más de un año después de que la startup con sede en Hangzhou provocara una caída bursátil de un billón de dólares con el lanzamiento del R1, un modelo de código abierto que imita el proceso de razonamiento humano. El R1 rivalizaba con el rendimiento de sistemas de IA de vanguardia de empresas como OpenAI, pero supuestamente se construyó a una fracción del costo.

Las acciones de los fabricantes de chips chinos repuntaron el viernes, ya que los inversores apostaron a que el nuevo modelo impulsará la demanda de chips locales. En una publicación en redes sociales, DeepSeek indicó que la capacidad de servicio de la serie V4 Pro es extremadamente limitada debido a la escasez de recursos informáticos. Sin embargo, la startup prevé que el precio del modelo disminuya significativamente tras el lanzamiento de los clústeres de computación equipados con los chips Ascend 950 de Huawei en la segunda mitad de este año. DeepSeek se encuentra actualmente en conversaciones con Tencent y Alibaba para su primera ronda de financiación.

Las acciones de Semiconductor Manufacturing International, el principal fabricante de chips de Huawei, subieron hasta un 9,4% en Hong Kong, mientras que las de Hua Hong Semiconductor se dispararon más de un 13%. Sus rivales, como Knowledge Atlas Technology JSC Ltd. (o Zhipu), cayeron un 8%.

La nueva serie representa un gran avance en la escala y la eficiencia que han caracterizado el ascenso de DeepSeek y han ejercido una enorme presión competitiva sobre sus rivales. Tras el lanzamiento del R1, las empresas tecnológicas y los inversores comenzaron a replantearse la conveniencia de invertir miles de millones de dólares en el desarrollo de la IA. Sin embargo, esas inversiones se han recuperado, ya que se prevé que los gigantes tecnológicos estadounidenses inviertan alrededor de 650.000 millones de dólares en 2026 en infraestructura y centros de datos para IA.

El sistema de un billón de parámetros de DeepSeek utiliza la técnica de mezcla de expertos, que activa selectivamente solo un pequeño subconjunto de expertos y solo hasta 37 mil millones de parámetros por tarea para mantener los costos de inferencia mucho más bajos que para modelos de frontera similares.

La arquitectura y las técnicas empleadas posicionan a DeepSeek directamente frente a sus competidores de Silicon Valley, OpenAI, Google y los últimos modelos de Anthropic. El viernes, la startup destacó su rendimiento superior al de GPT-5.2 de OpenAI en pruebas de referencia estándar, pero reconoció que la versión 4 está entre 3 y 6 meses por detrás de los modelos de última generación.

Sin embargo, DeepSeek ha recalcado que no se centra únicamente en potencia bruta, sino también en reducir fundamentalmente los costes. El V4 está diseñado para implementarse en infraestructuras más económicas. "Minimax y Zhipu, como proveedores de modelos independientes, siempre serán vulnerables a la competencia, especialmente de las plataformas de internet o los proveedores de servicios en la nube, que tienen mayor alcance y distribución", afirmó Vey-Sern Ling, director general de Union Bancaire Privee. "Con el tiempo, la diferencia en el rendimiento de los modelos será imperceptible para la mayoría de los usuarios".

DeepSeek causa furor en China 

DeepSeek también causó furor en China, donde líderes tecnológicos como Alibaba y Baidu inundaron el mercado con servicios de IA de bajo costo. Competidores como ByteDance, Zhipu y Minimax se apresuraron a actualizar sus modelos en las semanas previas a abril, con la esperanza de aventajar a DeepSeek.

Con la fama también llegó el escrutinio. Líderes tecnológicos y funcionarios gubernamentales estadounidenses han acusado a DeepSeek de utilizar técnicas y hardware ilícitos para desarrollar sus modelos.

Uno de los aspectos clave es la denominada destilación, mediante la cual un modelo de IA se basa en la salida de otro para su entrenamiento y así desarrollar capacidades similares. Tanto OpenAI como Anthropic han afirmado haber detectado este tipo de ataques por parte de DeepSeek, una preocupación que OpenAI comenzó a plantear en privado poco después del lanzamiento del modelo R1.

La otra preocupación es que DeepSeek pueda tener acceso a chips de IA de Nvidia que están prohibidos, una posibilidad que los funcionarios estadounidenses comenzaron a investigar el año pasado.

Según fuentes familiarizadas con el asunto, el gobierno estadounidense cree que la empresa emergente china utilizó procesadores Nvidia Blackwell, cuya venta a China está prohibida, en un centro de datos en Mongolia Interior.