Saltar al contenido
NoCodaNOCODA.TVHABLEMOS →
PRODUCTOPlaud lanza auriculares con eSIM para agentes de IADATOBarret Zoph, ex-OpenAI, se une a GoogleFUNDINGOpenAI expande su presencia a BrasilDATOAustralia prohíbe IA generativa en listas musicalesMODELOReportan el ascenso de los modelos de IA pequeñosDATOIndustria IA critica plan de Trump de gravar chipsPRODUCTOGoogle Search integra IA para planificar y reservar viajesDATOJensen Huang (Nvidia) afirma haber logrado AGI 'sin sentido'BREAKINGOpenAI lanza publicidad en ChatGPT gratuito y Go en India con 50 marcas y ad manager desde septiembreBREAKINGGoogle Gemini Omni 1.1 Flash baja 60% el costo de generar video con IA y procesa más rápidoBREAKINGAnthropic lanza estándar para que agentes de IA controlen equipamiento físico de laboratorio y fábricaBREAKINGAnthropic firma contrato de US$45 mil millones con Nscale para capacidad de cómputo previo a su IPODATOAmazon triplica pedidos de chips Nvidia por demanda crecienteDATONvidia camino a ser empresa de $100 mil millones por trimestreBREAKINGSam Altman: AGI de OpenAI para fines de 2026 (según su definición)FUNDINGStartup viral Instinct levanta $350M con valuación de $2.5BFUNDINGAnthropic cierra acuerdo de $45B con Nscale por cómputo de IAPRODUCTOGoogle lanza Gemini 3.5 Transcribe, edita 'ums' y 'ahs'MODELOIBM libera Granite 4.2: modelos open-weight con agentesMODELOAlibaba lanza Qwen3.8-Flash-Next: eficiencia de costo extremaBREAKINGIsrael montó un think tank falso para manipular chatbots con propaganda disfrazada de investigación académicaBREAKINGMeta canceló plan para reemplazar 60% de empleados con IA tras aumento del 40% en incidentes técnicosBREAKINGNvidia compra Hugging Face por USD 12.900 millones mientras OpenAI y Anthropic desarrollan chips propiosBREAKINGZ.ai lanza GLM-5.3-Flash, modelo open source chino que promete alto rendimiento y costos reducidos

CÓDIGO ABIERTO

Meta lanza Muse Glimmer, un modelo de 30B para agentes de IA locales

Meta liberó Muse Glimmer con licencia Apache 2.0: un modelo multimodal de 30 mil millones de parámetros diseñado para correr en una PC o Mac con GPU común y ejecutar agentes autónomos sin conexión a internet.

11 DE AGOSTO DE 202611 AGOLECTURA 3 MINREDACTADO POR IA
Meta lanza Muse Glimmer, un modelo de 30B para agentes de IA locales
ILUSTRACIÓN GENERADA POR IA — IDENTIDAD VISUAL NOCODA.TV

Meta acaba de lanzar Muse Glimmer, un modelo de lenguaje de 30 mil millones de parámetros optimizado para ejecutar agentes de IA directamente en tu computadora, sin depender de la nube. El modelo está disponible bajo licencia Apache 2.0 en Hugging Face, y según Meta AI Research, fue diseñado específicamente para casos de uso como llamadas a funciones, generación de código local y evaluación de modelos.

A diferencia de los grandes modelos que requieren servidores remotos, Muse Glimmer corre en una Mac o PC con una sola GPU de consumo, habilitando IA funcional con o sin conexión a internet. La compañía aplicó técnicas de cuantización para comprimir el modelo a aproximadamente 4 bits de precisión, reduciendo su tamaño a menos de 20 GB y permitiendo que quepa en GPUs de 24 o 32 GB junto con su memoria de trabajo y codificador de percepción.

Entrenado para agentes autónomos

Meta entrenó Muse Glimmer en tres fases: pre-entrenamiento con destilación de logits desde Muse Spark (un modelo teacher mucho más grande), mid-training con datos de contexto largo y trazas de razonamiento enriquecidas, y post-training combinando fine-tuning supervisado con destilación on-policy y aprendizaje por refuerzo.

El resultado es un modelo que maneja razonamiento multimodal (acepta texto e imágenes intercaladas), llamadas a herramientas con esquemas precisos, recuperación ante errores (diagnostica fallos de herramientas y reintenta en lugar de detenerse) y ejecución de tareas de principio a fin en benchmarks como DeepSearch QA, MCP-Atlas, τ-Bench y SWE-Bench.

Muse Glimmer también soporta más de 100 idiomas y ofrece modos de razonamiento ajustables para equilibrar calidad y velocidad según la tarea. Las integraciones optimizadas para llama.cpp, MLX y ExecuTorch estarán disponibles en los próximos días.

Velocidad local con speculative decoding

Para que un agente local sea útil en trabajo real, necesita responder rápido. Meta incluyó un modelo "drafter" ligero basado en DFlash que propone bloques completos de tokens de una vez; el modelo principal valida esas propuestas en paralelo, acelerando la generación sin sacrificar coherencia. Esto hace que Muse Glimmer se sienta responsivo incluso en cadenas de razonamiento largas o llamadas a herramientas múltiples.

Por qué importa

Muse Glimmer refuerza la estrategia de IA abierta y edge computing de Meta: en lugar de concentrar inteligencia en datacenters remotos, empuja capacidades avanzadas hacia el dispositivo del usuario. Esto tiene implicaciones directas para privacidad (el contexto personal nunca sale de tu máquina), latencia (sin roundtrips a la nube) y disponibilidad (funciona offline).

Para empresas que construyen asistentes internos, herramientas de análisis de documentos o agentes de soporte, un modelo como Muse Glimmer abre la puerta a arquitecturas híbridas: razonamiento sensible en el dispositivo, con llamadas selectivas a modelos más grandes solo cuando sea necesario. Es un cambio de paradigma desde "todo en la nube" hacia infraestructura de IA distribuida que balancea costo, control y velocidad.

#meta#muse glimmer#agentes#modelos abiertos#edge computing

SEGUIR LA SEÑAL

VER TODO →