Saltar al contenido
NoCodaNOCODA.TVHABLEMOS →
FUNDINGAccel en conversaciones para invertir $1B en Thinking MachinesDATOSam Altman advierte sobre exceso "insostenible" en cómputo de IAMODELOK2 Horizon lanza seis nuevos modelos de IA de código abiertoMODELONuevo modelo de Google mejora drásticamente pronóstico del tiempoPRODUCTOOllie apuesta a la privacidad para ganar carrera de asistentes de IADATOMeta paga a usuarios para monitorear uso de su modelo de IAPRODUCTOAbliteration.ai: negocio de eliminar salvaguardas de IABREAKINGCrusoe levanta USD 3.000 M y triplica valuación en 10 meses con infraestructura de IA alimentada por energía varadaBREAKINGOpenAI destina US$1.000 millones para que defensores cibernéticos protejan infraestructura crítica con IABREAKINGNvidia lanza PAIR: software gratuito que conecta tus PCs para crear un centro de IA localDATONueva York restringe uso de IA en escuelas hasta nivel secundariaMODELOQuasar 438B: Europa presenta su nuevo modelo de IA líderFUNDINGPalo Alto Networks adquiere la startup Console por $500 millonesMODELOOpenAI califica a Astra como su modelo más 'peligroso' y difícil de monitorearDATOMilitares de EE.UU. añaden ChatGPT y Grok a su plataforma GenAI.milPRODUCTOChatGPT: 3 días de trabajo en 3 horas para ATV Big Air TourFUNDINGHiddenLayer obtiene $100M para proteger despliegues de IA empresarialMODELOMeta anuncia Muse Spark 1.3, su nuevo modelo de IA generativaBREAKINGAnthropic invierte USD 35.000 millones con Lambda para expandir infraestructura de Claude en TexasBREAKINGEl DOJ de EE.UU. respalda el uso justo para entrenar IA en el caso del New York Times vs OpenAIBREAKINGGoogle lanza Gemini 3.8 Flash con variante especializada en ciberseguridad al mismo precio que 3.7DATOBenchMIRT: ¿Qué miden realmente los benchmarks de LLM?PRODUCTOHugging Face lanza 200+ WebGPU Kernels para IA localPRODUCTOChatGPT se integra con historiales de salud para organizaciones médicas

DATOS ABIERTOS

LAION lanza dataset de 10 millones de horas de video para entrenar modelos de IA

El dataset Big Video Dataset (BVD) contiene 55 millones de clips con descripciones de audio y video generadas automáticamente, más 300 millones de imágenes. Modelos entrenados con BVD superan a InternVid por hasta 2,1 puntos porcentuales.

29 DE AGOSTO DE 202629 AGOLECTURA 3 MINREDACTADO POR IA
LAION lanza dataset de 10 millones de horas de video para entrenar modelos de IA
ILUSTRACIÓN GENERADA POR IA — IDENTIDAD VISUAL NOCODA.TV

LAION acaba de liberar el Big Video Dataset (BVD), uno de los conjuntos de datos de video más grandes disponibles para investigación en inteligencia artificial. La organización descargó 80 millones de videos (10 millones de horas totales) a partir de 1.300 millones de URLs de video encontradas en CommonCrawl, y extrajo 55 millones de clips con descripciones automáticas de video y audio, además de 300 millones de imágenes fijas.

La mayoría de los videos provienen de YouTube y están en inglés, según informó The Decoder.

Rendimiento superior en benchmarks

Según el paper que acompaña el lanzamiento, los modelos entrenados con BVD superan a modelos comparables entrenados con InternVid por hasta 2,1 puntos porcentuales en benchmarks estándar de video-a-texto. El entrenamiento vincula video, audio y texto, enseñando al modelo qué contenido visual corresponde con qué descripciones o sonidos.

Esta integración multimodal permite que los sistemas aprendan relaciones más complejas entre lo que se ve, lo que se escucha y cómo se describe.

Solo para uso no comercial

LAION libera el dataset exclusivamente para investigación. La organización se apoya en un fallo del Tribunal Regional de Hamburgo de 2024 que le permitió recolectar contenido con derechos de autor para investigación no comercial. LAION pide explícitamente a los usuarios que respeten los derechos de los creadores originales de contenido.

El dataset y el código están disponibles gratuitamente.

Por qué importa

Este lanzamiento democratiza el acceso a datos de entrenamiento de video a una escala que antes solo estaba disponible para laboratorios con presupuestos multimillonarios. Para equipos de investigación y empresas que desarrollan modelos de IA generativa de video, tener 10 millones de horas etiquetadas reduce drásticamente la barrera de entrada.

Para organizaciones que construyen aplicaciones de IA sobre video — análisis de contenido, moderación, búsqueda semántica, generación — este tipo de recurso abierto acelera la experimentación sin depender de datasets propietarios. La ventaja de 2,1 puntos sobre InternVid puede parecer marginal, pero en benchmarks competitivos esa diferencia separa un modelo útil de uno comercializable.

La restricción a uso no comercial limita aplicaciones directas en producto, pero no impide que las empresas entrenen prototipos, validen hipótesis o comparen arquitecturas antes de invertir en datos propios.

#laion#datasets#video#investigación#open source

SEGUIR LA SEÑAL

VER TODO →