Bitget App
Trading Inteligente
Comprar criptoMercadosTradingFuturosStocksEarnInstituciónIA y más
DeepSeek V4 revela: crisis de programación de GPT/Claude durante el Año Nuevo Chino

DeepSeek V4 revela: crisis de programación de GPT/Claude durante el Año Nuevo Chino

量子位量子位2026/01/10 01:37
Mostrar el original
Por:量子位
🧨Se acerca el Año Nuevo Chino y este año DeepSeek está a punto de sorprender al mundo nuevamente🧨📄Según información de medios internacionales como The Information, dos personas con conocimiento directo del plan revelaron que DeepSeek lanzará la V4 a mediados de febrero, alrededor del Año Nuevo Chino, aunque la fecha podría ajustarse.💪DeepSeek-V4 se destaca por su capacidad de codificación; los resultados preliminares de las pruebas internas muestran que ya ha superado a modelos existentes como Claude de Anthropic y la serie GPT de OpenAI.Las dos fuentes también agregaron que las innovaciones clave de la V4 se reflejan en dos aspectos:1️⃣ Logró avances fundamentales en el procesamiento y análisis de prompts de código extremadamente largos.2️⃣ Durante todas las etapas del proceso de entrenamiento, la capacidad de comprensión de patrones de datos no mostró deterioro en el rendimiento, y presenta una mejora significativa respecto a las versiones anteriores.PD: El proceso de entrenamiento de modelos de IA exige que el modelo aprenda repetidamente de conjuntos de datos masivos. Sin embargo, en la práctica, a medida que aumentan las rondas de entrenamiento, la capacidad del modelo para captar patrones de datos suele disminuir. Para los desarrolladores con grandes reservas de chips de IA, la forma habitual de abordar este problema es aumentar las rondas de entrenamiento para compensar la pérdida de rendimiento.🧐Es muy probable que los usuarios noten en el uso real que las respuestas generadas por la V4 tienen una lógica más clara y una estructura mejor organizada. Esto indica que el modelo posee habilidades de razonamiento profundo más sólidas y su fiabilidad en tareas complejas se verá considerablemente mejorada.Cabe mencionar que algunos usuarios notaron que en el paper de DeepSeek-V3.2 se menciona el uso de la plataforma de competencia de grandes modelos (ChatbotArena) para la evaluación de preferencias humanas.Por lo tanto, es posible que podamos probar este modelo en la competencia de grandes modelos incluso antes de lo esperado.
0
0

Descargo de responsabilidad: El contenido de este artículo refleja únicamente la opinión del autor y no representa en modo alguno a la plataforma. Este artículo no se pretende servir de referencia para tomar decisiones de inversión.

PoolX: Haz staking y gana nuevos tokens.
APR de hasta 12%. Gana más airdrop bloqueando más.
¡Bloquea ahora!

También te puede gustar

A pesar de la caída en los precios del petróleo y del tono dovish de los altos cargos de la Reserva Federal, los rendimientos de los bonos del Tesoro estadounidense siguen subiendo.

La ola de ventas de bonos del Tesoro de EE.UU. continúa expandiéndose, con el rendimiento a 30 años alcanzando un máximo de 24 años en 5,621% y el rendimiento a 10 años llegando a su punto más alto desde 2002. Ni la caída en los precios del petróleo ni las señales dovish han logrado frenar esta tendencia, con las tasas de interés a largo plazo manteniendo su propio rumbo. Los altos rendimientos están remodelando la estructura de las acciones estadounidenses; cuando la narrativa de la IA se convierte en el último pilar del mercado, cualquier grieta puede desencadenar una cadena de turbulencias.

华尔街见闻•2026/09/30 00:41

La mesa de operaciones de JPMorgan, considerada "la más precisa de los últimos dos años", se vuelve alcista.

La lógica de soporte abarca cinco pilares: expectativas macroeconómicas superiores, resiliencia del consumidor, expectativas de ganancias bajas, estabilización de los rendimientos y mejora técnica. Desde el último cambio de tendencia el 31 de agosto, el trade largo en Nasdaq 100 y corto en Russell 2000 acumuló un alza superior al 8%; esta vez, el giro hacia una postura más alcista es aún más convincente. En cuanto a estrategia, la tecnología sigue siendo el eje central de la posición larga, pero la herramienta de cobertura cambia de las posiciones cortas en RTY a derivados, a la vez que se indica que persiste el riesgo de un aumento de tasas a largo plazo.

华尔街见闻•2026/09/30 00:16
La mesa de operaciones de JPMorgan, considerada "la más precisa de los últimos dos años", se vuelve alcista.