Saltar al contenido
NoCodaNOCODA.TVHABLEMOS →
PRODUCTOPlaud lanza auriculares con eSIM para agentes de IADATOBarret Zoph, ex-OpenAI, se une a GoogleFUNDINGOpenAI expande su presencia a BrasilDATOAustralia prohíbe IA generativa en listas musicalesMODELOReportan el ascenso de los modelos de IA pequeñosDATOIndustria IA critica plan de Trump de gravar chipsPRODUCTOGoogle Search integra IA para planificar y reservar viajesDATOJensen Huang (Nvidia) afirma haber logrado AGI 'sin sentido'BREAKINGOpenAI lanza publicidad en ChatGPT gratuito y Go en India con 50 marcas y ad manager desde septiembreBREAKINGGoogle Gemini Omni 1.1 Flash baja 60% el costo de generar video con IA y procesa más rápidoBREAKINGAnthropic lanza estándar para que agentes de IA controlen equipamiento físico de laboratorio y fábricaBREAKINGAnthropic firma contrato de US$45 mil millones con Nscale para capacidad de cómputo previo a su IPODATOAmazon triplica pedidos de chips Nvidia por demanda crecienteDATONvidia camino a ser empresa de $100 mil millones por trimestreBREAKINGSam Altman: AGI de OpenAI para fines de 2026 (según su definición)FUNDINGStartup viral Instinct levanta $350M con valuación de $2.5BFUNDINGAnthropic cierra acuerdo de $45B con Nscale por cómputo de IAPRODUCTOGoogle lanza Gemini 3.5 Transcribe, edita 'ums' y 'ahs'MODELOIBM libera Granite 4.2: modelos open-weight con agentesMODELOAlibaba lanza Qwen3.8-Flash-Next: eficiencia de costo extremaBREAKINGIsrael montó un think tank falso para manipular chatbots con propaganda disfrazada de investigación académicaBREAKINGMeta canceló plan para reemplazar 60% de empleados con IA tras aumento del 40% en incidentes técnicosBREAKINGNvidia compra Hugging Face por USD 12.900 millones mientras OpenAI y Anthropic desarrollan chips propiosBREAKINGZ.ai lanza GLM-5.3-Flash, modelo open source chino que promete alto rendimiento y costos reducidos

MODELOS OPEN SOURCE

DeepSeek V4 Flash iguala a GPT-5.6 Luna con 60% menos de costo

El nuevo modelo de razonamiento de DeepSeek alcanza 50 puntos en el Intelligence Index —mismo nivel que los líderes propietarios— a $0.14 por millón de tokens de entrada. Con pesos abiertos bajo licencia MIT y 284B parámetros totales.

1 DE AGOSTO DE 20261 AGOLECTURA 3 MINREDACTADO POR IA
DeepSeek V4 Flash iguala a GPT-5.6 Luna con 60% menos de costo
ILUSTRACIÓN GENERADA POR IA — IDENTIDAD VISUAL NOCODA.TV

DeepSeek lanzó en julio de 2026 la versión V4 Flash 0731, un modelo de razonamiento con pesos abiertos que alcanza 50 puntos en el Artificial Analysis Intelligence Index, ubicándose en el puesto 3 de 101 modelos evaluados. Según el análisis publicado por Artificial Analysis, ese score lo pone a la par de los modelos propietarios más avanzados, pero a una fracción del precio habitual: $0.14 por millón de tokens de entrada y $0.28 por millón de salida.

Arquitectura y capacidades

El modelo cuenta con 284B parámetros totales y activa 13B por token durante la inferencia. Soporta ventanas de contexto de 1M tokens (equivalente a ~1500 páginas A4) y genera únicamente texto a partir de entradas de texto. Los pesos están disponibles en Hugging Face bajo licencia MIT, lo que permite uso comercial sin restricciones mayores.

En los nueve benchmarks que componen el Intelligence Index v4.1 —incluyendo GDPval-AA v2, τ³-Banking, Terminal-Bench v2.1, SciCode, GPQA Diamond y Humanity's Last Exam— DeepSeek V4 Flash superó ampliamente la mediana de 25 puntos de modelos comparables. Durante la evaluación generó 210M tokens, una verbosidad alta frente a la mediana de 100M.

Precio competitivo en su clase

El costo total de ejecutar el Intelligence Index sobre este modelo fue de $72.02. En comparación, la mediana de precios de entrada para modelos de similar inteligencia es $0.43 por millón de tokens (DeepSeek cobra $0.14) y la de salida es $1.20 (DeepSeek cobra $0.28). Eso representa un ahorro de ~67% en entrada y ~77% en salida.

Artificial Analysis ubica a DeepSeek V4 Flash en el puesto 22 de 101 en precio, clasificándolo como «competitively priced». Además, el modelo ofrece cache hit a $0.003 por millón de tokens (98% de descuento), el precio más bajo en esa métrica entre los modelos listados.

Por qué importa

La aparición de un modelo open source que empata en inteligencia con los líderes propietarios, mientras cobra menos de un tercio del precio promedio, cambia la ecuación de adopción. Para equipos que están evaluando LLMs en producción —especialmente en latitudes donde el precio del token pesa fuerte en el P&L— tener acceso a pesos bajo MIT significa control total del deployment, latencia y privacidad.

Si tu stack ya incluye modelos de razonamiento para tareas complejas (análisis de documentos largos, troubleshooting técnico, síntesis de datasets), DeepSeek V4 Flash es una alternativa seria que podés hostear o consumir vía API sin quedar atado a un proveedor propietario. La ventana de 1M tokens es otro diferencial: procesás contratos, transcripciones o repositorios completos sin partir el contexto.

En un mercado donde OpenAI, Anthropic y Google dominan por benchmark, un jugador chino que publica pesos completos y bate récords de eficiencia obliga a toda la industria a recalibrar precio y accesibilidad. Para empresas de habla hispana que recién empiezan a escalar IA, esto significa que la barrera de entrada técnica y financiera acaba de bajar un escalón más.

#deepseek#modelos de lenguaje#open source#benchmarks#razonamiento

SEGUIR LA SEÑAL

VER TODO →