Amazon Despliega Tecnología Cerebras 25 Veces Más Rápido Que GPUs Nvidia

News

Por Wendy Frey

medium-vecteezy_elevating-businesses-with-cloud-computing-innovations-ai_33100055_medium.jpg Andrew Feldman firmó el trato de su vida el 13 de marzo. Amazon Web Services, rey de las nubes, acordó desplegar chips Cerebras CS-3 directamente dentro de sus centros de datos. Primera asociación de hyperscaler. Nunca antes. Los insurgentes de tamaño de oblea finalmente entraron en la fortaleza.

Los números explotan. Cerebras afirma que sus chips del tamaño de un plato sirven respuestas de IA 25 veces más rápido que las GPUs Nvidia. Trainium maneja el aviso. CS-3 aplasta la salida. David Brown, VP de AWS Compute, lo llama un salto de "orden de magnitud". OpenAI ya apostó $10 mil millones por Feldman en enero. Ahora Amazon refuerza la apuesta. Bedrock se convierte en la puerta de entrada a una inferencia abrasadora.

Arquitectura Desagregada Despoja la Corona de Nvidia

Las entrañas técnicas revelan una brutal astucia. AWS divide la inferencia en dos. Trainium3 gestiona la etapa de prellenado. Cerebras WSE-3 decodifica la salida. Elastic Fabric Adapter los une. ¿Resultado? Cinco veces más capacidad de tokens a alta velocidad en la misma huella.

Nvidia dominó ambas fases durante años. Ya no. Startups como Cognition y Mistral ya huyeron a Cerebras para codificación agente. Ahora AWS lo ofrece al público general. La startup de $23 mil millones (recién salida de una ronda de $1 mil millones de Tiger Global en febrero) finalmente desafía la supremacía de las GPU a gran escala. No más compra de cajas Cerebras. Solo alquila a través de Bedrock.

Temporización de la Copa Mundial 2026. La Guerra de Inferencia Empresarial Explota

La velocidad mata. Cerebras entrega miles de tokens por segundo mientras las GPUs se ahogan en cientos. Asistencia de codificación en tiempo real. Agentes interactivos. Modelos de razonamiento que "piensan" a través de problemas, generando 15 veces más tokens. Feldman construyó su imperio sobre estas cargas de trabajo.

AWS lo despliega "en los próximos meses". La segunda mitad de 2026 verá el despliegue completo. Amazon Nova y LLMs de código abierto funcionan en silicio de tamaño de oblea. El acuerdo de $10 mil millones con OpenAI (750 megavatios hasta 2028) de repente tiene sentido. Feldman demostró su tecnología a gran escala. Ahora AWS la lleva a millones de empresas. El cuello de botella de inferencia muere. Las etiquetas de precio siguen siendo premium. Pero para las cargas de trabajo de "el tiempo es dinero", Nvidia finalmente enfrenta un calor real en la nube.

Plantillas virales

Explora nuestras plantillas virales con IA y aplícalas a tus fotos.

Explorar plantillas