<?xml version="1.0" encoding="UTF-8"?><rss version="2.0"><channel><title>El Compilado — Cerebras</title><description>Cada noticia sobre Cerebras del briefing diario de El Compilado.</description><link>https://elcompilado.com</link><language>es</language><item><title>OpenAI + Cerebras: &quot;Ultrafast mode&quot; corre GPT-5.6 Sol a 750 tokens/s</title><link>https://elcompilado.com/blog/briefing-tech-2026-08-14/#openai-cerebras-ultrafast-mode-corre-gpt-5-6-sol</link><guid isPermaLink="true">https://elcompilado.com/blog/briefing-tech-2026-08-14/#openai-cerebras-ultrafast-mode-corre-gpt-5-6-sol</guid><description>OpenAI anunció el 13 de agosto un nuevo tier de servicio en la API que entrega hasta 14× la velocidad del modo Standard con el mismo modelo y la misma inteligencia, no una versión destilada. Corre sobre el Wafer-Scale Engine de Cerebras, que mantiene los pesos en 44 GB de SRAM on-chip para esquivar el cuello de botella de ancho de banda de memoria. En Humanity&apos;s Last Exam resolvió las 2.500 preguntas en poco más de 11 horas (~7× más rápido que Claude Fable 5 con precisión comparable) y en GDP-Val dio 5.6× de speedup end-to-end sin pérdida de calidad. Por ahora es preview limitado. Casos citados: respuesta a incidentes, soporte, análisis de mercados, e-commerce. OpenAI · TechCrunch · Cerebras (nota de prensa)

Fuentes: https://openai.com/index/previewing-ultrafast/ · https://techcrunch.com/2026/08/13/openai-introduces-ultrafast-a-new-mode-that-makes-gpt-5-6-sol-work-at-14x-the-speed/ · https://www.globenewswire.com/news-release/2026/08/13/3344804/0/en/cerebras-powers-ultrafast-mode-for-openai-s-gpt-5-6-sol.html</description><pubDate>Fri, 14 Aug 2026 00:00:00 GMT</pubDate><category>ia</category><category>openai</category><category>cerebras</category><category>gpt</category><category>claude</category></item><item><title>Cerebras cae ~20% en bolsa el mismo día que anuncia lo de OpenAI</title><link>https://elcompilado.com/blog/briefing-tech-2026-08-14/#cerebras-cae-20-en-bolsa-el-mismo-dia-que</link><guid isPermaLink="true">https://elcompilado.com/blog/briefing-tech-2026-08-14/#cerebras-cae-20-en-bolsa-el-mismo-dia-que</guid><description>Contraste llamativo del 13 de agosto: mientras la compañía publicaba el logro técnico de Ultrafast, sus resultados quedaron por debajo de expectativas. La venta de hardware cayó, pero los ingresos de su nube de IA subieron 281% — señal de que el modelo de negocio se está corriendo de vender wafers a vender inferencia. Tom&apos;s Hardware

Fuentes: https://www.tomshardware.com/tech-industry/artificial-intelligence/cerebras-shares-plunge-nearly-20-percent-after-missing-earnings-expectations-hardware-sales-drop-but-ai-cloud-revenue-climbs-281-percent</description><pubDate>Fri, 14 Aug 2026 00:00:00 GMT</pubDate><category>hardware</category><category>openai</category><category>cerebras</category></item><item><title>El writeup técnico de Cerebras sobre cómo sirven GPT-5.6 Sol a 750 tok/s</title><link>https://elcompilado.com/blog/briefing-tech-2026-08-14/#el-writeup-tecnico-de-cerebras-sobre-como-sirven-gpt</link><guid isPermaLink="true">https://elcompilado.com/blog/briefing-tech-2026-08-14/#el-writeup-tecnico-de-cerebras-sobre-como-sirven-gpt</guid><description>Más allá del anuncio comercial, el post de ingeniería explica la apuesta contraria al consenso: la inferencia en modelos grandes está limitada por ancho de banda de memoria, así que en lugar de optimizar el movimiento de pesos los meten enteros en 44 GB de SRAM por wafer y pipelinean las capas del modelo entre wafers, con los tokens fluyendo sin interrupción. Lectura obligada si estás pensando en serving y en el trade-off latencia/costo/calidad. Cerebras

Fuentes: https://www.cerebras.ai/blog/accelerating-gpt-5-6-sol-ultrafast-with-openai</description><pubDate>Fri, 14 Aug 2026 00:00:00 GMT</pubDate><category>tecnicas</category><category>cerebras</category><category>gpt</category></item><item><title>AMD y Cerebras se alían para inferencia híbrida</title><link>https://elcompilado.com/blog/briefing-tech-2026-07-25/#amd-y-cerebras-se-alian-para-inferencia-hibrida</link><guid isPermaLink="true">https://elcompilado.com/blog/briefing-tech-2026-07-25/#amd-y-cerebras-se-alian-para-inferencia-hibrida</guid><description>AMD cerró una asociación con Cerebras Systems que permitirá dividir cargas de inferencia de IA entre hardware de ambos. Cerebras incorporará sistemas Helios de AMD en sus data centers y ofrecerá la infraestructura combinada a través de Cerebras Cloud más adelante este año. Es otra señal de la estrategia de AMD de ganar terreno en inferencia frente a Nvidia. Tech Startups

Fuentes: https://techstartups.com/2026/07/24/top-tech-news-today-july-24-2026-amd-apple-google-intel-oracle-samsung-spacex-more/</description><pubDate>Sat, 25 Jul 2026 00:00:00 GMT</pubDate><category>hardware</category><category>nvidia</category><category>amd</category><category>cerebras</category></item><item><title>OpenAI recibe luz verde para el despliegue público de GPT-5.6</title><link>https://elcompilado.com/blog/briefing-tech-2026-07-08/#openai-recibe-luz-verde-para-el-despliegue-publico-de</link><guid isPermaLink="true">https://elcompilado.com/blog/briefing-tech-2026-07-08/#openai-recibe-luz-verde-para-el-despliegue-publico-de</guid><description>El Departamento de Comercio de EE.UU. autorizó la salida amplia de GPT-5.6, que hasta ahora estaba limitado a unas 20 organizaciones socias bajo revisión de seguridad del gobierno. Es una familia de tres modelos —Sol (flagship), Terra (costo medio) y Luna (el más rápido y económico)— con contexto de 2M de tokens y precio de referencia de US$5/US$30 por millón (entrada/salida). OpenAI también anunció que servirá GPT-5.6 Sol sobre Cerebras a hasta 750 tokens/segundo. OpenAI · Cyberpress · Wikipedia

Fuentes: https://openai.com/index/previewing-gpt-5-6-sol/ · https://cyberpress.org/gpt-5-6-launch-cleared-openai/ · https://en.wikipedia.org/wiki/GPT-5.6</description><pubDate>Wed, 08 Jul 2026 00:00:00 GMT</pubDate><category>ia</category><category>openai</category><category>cerebras</category><category>gpt</category></item><item><title>OpenAI arranca a servir GPT-5.6 Sol sobre Cerebras a ~750 tokens/s</title><link>https://elcompilado.com/blog/briefing-tech-2026-07-06/#openai-arranca-a-servir-gpt-5-6-sol-sobre</link><guid isPermaLink="true">https://elcompilado.com/blog/briefing-tech-2026-07-06/#openai-arranca-a-servir-gpt-5-6-sol-sobre</guid><description>OpenAI comenzó a desplegar su modelo tope de gama GPT-5.6 Sol corriendo sobre aceleradores de Cerebras, alcanzando hasta ~750 tokens por segundo, una velocidad inédita para un modelo frontera. El acceso sigue restringido a un grupo acotado de clientes mientras escalan capacidad, y el lanzamiento llega con el stack de seguridad más robusto de OpenAI hasta la fecha (protecciones extra para pedidos sensibles de ciberseguridad y abuso reiterado). La familia se completa con Terra (equilibrado) y Luna (rápido y barato). OpenAI · VentureBeat

Fuentes: https://openai.com/index/previewing-gpt-5-6-sol/ · https://venturebeat.com/technology/openai-unveils-gpt-5-6-sol-terra-and-luna-models-but-only-accessible-to-limited-preview-partners-for-now-per-us-gov</description><pubDate>Mon, 06 Jul 2026 00:00:00 GMT</pubDate><category>ia</category><category>openai</category><category>cerebras</category><category>gpt</category></item></channel></rss>