Saltar al contenido
NoCodaNOCODA.TVHABLEMOS →
PRODUCTOPlaud lanza auriculares con eSIM para agentes de IADATOBarret Zoph, ex-OpenAI, se une a GoogleFUNDINGOpenAI expande su presencia a BrasilDATOAustralia prohíbe IA generativa en listas musicalesMODELOReportan el ascenso de los modelos de IA pequeñosDATOIndustria IA critica plan de Trump de gravar chipsPRODUCTOGoogle Search integra IA para planificar y reservar viajesDATOJensen Huang (Nvidia) afirma haber logrado AGI 'sin sentido'BREAKINGOpenAI lanza publicidad en ChatGPT gratuito y Go en India con 50 marcas y ad manager desde septiembreBREAKINGGoogle Gemini Omni 1.1 Flash baja 60% el costo de generar video con IA y procesa más rápidoBREAKINGAnthropic lanza estándar para que agentes de IA controlen equipamiento físico de laboratorio y fábricaBREAKINGAnthropic firma contrato de US$45 mil millones con Nscale para capacidad de cómputo previo a su IPODATOAmazon triplica pedidos de chips Nvidia por demanda crecienteDATONvidia camino a ser empresa de $100 mil millones por trimestreBREAKINGSam Altman: AGI de OpenAI para fines de 2026 (según su definición)FUNDINGStartup viral Instinct levanta $350M con valuación de $2.5BFUNDINGAnthropic cierra acuerdo de $45B con Nscale por cómputo de IAPRODUCTOGoogle lanza Gemini 3.5 Transcribe, edita 'ums' y 'ahs'MODELOIBM libera Granite 4.2: modelos open-weight con agentesMODELOAlibaba lanza Qwen3.8-Flash-Next: eficiencia de costo extremaBREAKINGIsrael montó un think tank falso para manipular chatbots con propaganda disfrazada de investigación académicaBREAKINGMeta canceló plan para reemplazar 60% de empleados con IA tras aumento del 40% en incidentes técnicosBREAKINGNvidia compra Hugging Face por USD 12.900 millones mientras OpenAI y Anthropic desarrollan chips propiosBREAKINGZ.ai lanza GLM-5.3-Flash, modelo open source chino que promete alto rendimiento y costos reducidos

STREAMING Y MACHINE LEARNING

Netflix prueba un modelo de lenguaje para reemplazar su sistema de recomendación

La plataforma desarrolló GenRec, un sistema basado en IA generativa que superó su motor de recomendación tradicional usando 40 veces menos datos de entrenamiento. El experimento con usuarios reales mostró mejoras medibles.

22 DE AGOSTO DE 2026HACE 6 DÍASLECTURA 4 MINREDACTADO POR IA
Netflix prueba un modelo de lenguaje para reemplazar su sistema de recomendación
ILUSTRACIÓN GENERADA POR IA — IDENTIDAD VISUAL NOCODA.TV

Netflix construyó un sistema de recomendación basado en modelos de lenguaje que superó a su infraestructura actual, desarrollada durante años. El proyecto, llamado GenRec, necesitó una fracción de los datos de entrenamiento que requiere el sistema en producción y mostró mejoras estadísticamente significativas en pruebas con usuarios reales, según publicó el equipo técnico de Netflix esta semana.

El sistema actual de la plataforma depende de miles de características diseñadas manualmente sobre usuarios, títulos e interacciones. Esa complejidad encarece la incorporación de nuevos formatos como videojuegos, transmisiones en vivo o podcasts, y dificulta expandir recomendaciones a otras áreas de la interfaz.

Cómo funciona GenRec

Netflix entrena un modelo propietario en dos etapas. Primero ajusta un modelo de lenguaje de pesos abiertos (no especifica cuál) con datos internos para que comprenda el catálogo y el comportamiento de usuarios. Luego, una segunda ronda de entrenamiento especializado convierte ese modelo base en un rankeador de recomendaciones que se actualiza con mayor frecuencia para incorporar títulos nuevos y cambios en las preferencias.

La diferencia clave: GenRec convierte el historial de visualización en texto plano en lugar de codificarlo como vectores numéricos densos. Reproducciones, duraciones, reacciones con pulgar arriba o abajo, agregados a listas y abandonos se transforman en una especie de diálogo entre el usuario y el sistema. El modelo identifica patrones como preferencias de género o cambios de interés por sí mismo, sin necesidad de características diseñadas manualmente.

Para evitar que el modelo sugiera títulos inexistentes en el catálogo, Netflix agregó un componente separado que solo califica entradas reales. El sistema corre sobre vLLM en un modo donde lee la entrada una vez y califica todos los candidatos en una sola pasada, sin generar texto, lo que mantiene los costos manejables.

Resultados de las pruebas

En evaluaciones offline, GenRec entregó 1,6% mejor calidad de ranking comparado con el sistema en producción. Necesitó aproximadamente 40 veces menos ejemplos etiquetados en la segunda etapa de entrenamiento para alcanzar ese resultado. Esa comparación aplica específicamente a la Fase 2, no a todos los datos de entrenamiento.

Netflix ejecutó un experimento A/B de cuatro semanas sobre aproximadamente el 10% de su tráfico, limitado a superficies de recomendación pre-computadas. Una métrica de corto plazo que rastrea comportamiento en la pantalla principal subió 0,115%, y una métrica central de largo plazo mejoró 0,006%. Ambas ganancias son demasiado grandes para explicarse por azar, según la compañía.

El ajuste fino específico para recomendaciones en la Fase 2 agrega entre 35% y 50% adicional sobre el rendimiento del modelo base. Cuando el modelo base tiene dos semanas de antigüedad, esa brecha se amplía a cerca del 80%, porque ya no refleja títulos nuevos ni preferencias modificadas. Los modelos de recomendación pierden vigencia rápido.

Por qué importa

Netflix ve a GenRec como parte de un cambio más amplio en la industria: pasar de arquitecturas personalizadas a modelos de lenguaje de propósito general que manejan múltiples casos de uso. El trabajo se desplaza de construir cada vez más características a decidir qué señales incluir en la entrada del modelo y en qué proporción. La infraestructura también migra hacia servidores GPU y herramientas para LLMs.

Este enfoque reduce drásticamente el esfuerzo de ingeniería para expandir recomendaciones a nuevos formatos de contenido. Lo que antes requería meses de desarrollo de características ahora puede resolverse ajustando el contexto textual que recibe el modelo. Para plataformas de comercio electrónico o productos digitales con catálogos dinámicos, el precedente es directo: sistemas de recomendación más flexibles que se adaptan más rápido y con menos datos.

El equipo de Netflix describe a GenRec como "un paso temprano pero prometedor" y aclara que no hay planes inmediatos para reemplazar completamente el sistema existente. La compañía lleva años usando machine learning más allá de las listas de recomendación: desde 2020 emplea grafos de conocimiento y modelos de similitud para predecir categorías de contenido y audiencias potenciales por país.

#netflix#sistemas de recomendación#modelos de lenguaje#personalización#streaming

SEGUIR LA SEÑAL

VER TODO →