Saltar al contenido
NoCodaNOCODA.TVHABLEMOS →
PRODUCTOPlaud lanza auriculares con eSIM para agentes de IADATOBarret Zoph, ex-OpenAI, se une a GoogleFUNDINGOpenAI expande su presencia a BrasilDATOAustralia prohíbe IA generativa en listas musicalesMODELOReportan el ascenso de los modelos de IA pequeñosDATOIndustria IA critica plan de Trump de gravar chipsPRODUCTOGoogle Search integra IA para planificar y reservar viajesDATOJensen Huang (Nvidia) afirma haber logrado AGI 'sin sentido'BREAKINGOpenAI lanza publicidad en ChatGPT gratuito y Go en India con 50 marcas y ad manager desde septiembreBREAKINGGoogle Gemini Omni 1.1 Flash baja 60% el costo de generar video con IA y procesa más rápidoBREAKINGAnthropic lanza estándar para que agentes de IA controlen equipamiento físico de laboratorio y fábricaBREAKINGAnthropic firma contrato de US$45 mil millones con Nscale para capacidad de cómputo previo a su IPODATOAmazon triplica pedidos de chips Nvidia por demanda crecienteDATONvidia camino a ser empresa de $100 mil millones por trimestreBREAKINGSam Altman: AGI de OpenAI para fines de 2026 (según su definición)FUNDINGStartup viral Instinct levanta $350M con valuación de $2.5BFUNDINGAnthropic cierra acuerdo de $45B con Nscale por cómputo de IAPRODUCTOGoogle lanza Gemini 3.5 Transcribe, edita 'ums' y 'ahs'MODELOIBM libera Granite 4.2: modelos open-weight con agentesMODELOAlibaba lanza Qwen3.8-Flash-Next: eficiencia de costo extremaBREAKINGIsrael montó un think tank falso para manipular chatbots con propaganda disfrazada de investigación académicaBREAKINGMeta canceló plan para reemplazar 60% de empleados con IA tras aumento del 40% en incidentes técnicosBREAKINGNvidia compra Hugging Face por USD 12.900 millones mientras OpenAI y Anthropic desarrollan chips propiosBREAKINGZ.ai lanza GLM-5.3-Flash, modelo open source chino que promete alto rendimiento y costos reducidos

HARDWARE DE IA

Cerebras duplica el rendimiento de su chip WSE-3 con el nuevo acelerador CS-4

La empresa presentó el CS-4, un sistema rack que entrega el doble de velocidad que su predecesor sin cambiar de chip: más frecuencia de reloj, mejor refrigeración y tres wafers por rack en lugar de dos. Cerebras afirma superar en 30× a configuraciones con GPUs de Nvidia.

25 DE AGOSTO DE 2026HACE 3 DÍASLECTURA 3 MINREDACTADO POR IA
Cerebras duplica el rendimiento de su chip WSE-3 con el nuevo acelerador CS-4
ILUSTRACIÓN GENERADA POR IA — IDENTIDAD VISUAL NOCODA.TV

Cerebras lanzó su acelerador CS-4, un sistema de IA a escala de rack completo que duplica el rendimiento del CS-3 anterior sin modificar el chip de base. El CEO Andrew Feldman lo presentó como el sistema más rápido de la industria, y la compañía lo posiciona como alternativa directa a las configuraciones basadas en GPUs de Nvidia.

Mismo chip, doble rendimiento

El CS-4 sigue usando el WSE-3 de 5 nm, pero logra el salto de velocidad aumentando la frecuencia de reloj mediante mayor potencia y refrigeración optimizada. Cada rack ahora integra tres wafers en lugar de dos y alcanza hasta 4.400 tokens por segundo por usuario, según The Decoder.

Cerebras afirma que esa cifra representa hasta 30 veces más velocidad que configuraciones equivalentes sobre GPUs de Nvidia. La capacidad de memoria se mantiene en 44 GB por wafer.

El sistema llega como producto rack-scale: un gabinete servidor completo que se instala en el data center como una sola unidad, con cómputo, alimentación y refrigeración integrados.

Arquitectura modular y socios de inferencia

El CS-4 introduce un diseño modular denominado «Backpack», pensado para acelerar el ensamblaje. Además, Cerebras incorpora inferencia desagregada mediante alianzas con AMD y AWS Trainium.

Analistas de SemiAnalysis califican las mejoras de networking como modestas. Se esperan más detalles técnicos en la conferencia Hot Chips.

Entre los casos de uso confirmados está Codex Spark de OpenAI, que ya corre sobre hardware de Cerebras.

Por qué importa

Duplicar el throughput sin rediseñar el chip demuestra que queda margen para exprimir eficiencia de la arquitectura wafer-scale de Cerebras. Para los operadores de infraestructura, ese salto puede traducirse en menor costo por token y en reducción de latencia sin cambiar el footprint físico de los racks.

La estrategia de inferencia desagregada con socios como AMD y AWS Trainium abre la puerta a configuraciones híbridas que combinen el throughput de Cerebras con la flexibilidad de otros aceleradores, ampliando el rango de cargas de trabajo que una empresa puede soportar sin multiplicar proveedores.

Si Cerebras logra mantener la curva de mejora por generación —y escalar producción— el panorama de proveedores de cómputo de IA podría volverse más competitivo justo cuando los modelos grandes empiezan a saturar la capacidad disponible de GPU.

#cerebras#cs-4#aceleradores#inferencia#chips

SEGUIR LA SEÑAL

VER TODO →