-
xAI lanzó Grok 4.7 después de cinco postergaciones, y empata con MiMo en el índice pagando cinco veces más (21/09)
El modelo tiene 2,1 billones de parámetros, 40% más que Grok 4.6, se apoya en una corrida más larga de aprendizaje por refuerzo y en entrenamiento que pesa más las tareas difíciles de horas. xAI también le metió datos suplementarios traídos de SpaceX: telemetría de satélites Starlink, registros de fabricación y bitácoras de fallas de ingeniería. Cuesta 2 dólares el millón de entrada y 6 el de salida, más cerca de los modelos chinos que de la frontera occidental, y saca 46 en el índice de Artificial Analysis contra los 53 de Claude Fable 5.1 y GPT-6. La brecha se abre en lo agéntico: 26% en Terminal-Bench 4.0, contra 60% de GPT-6 Astra y 55% de Fable 5.1, por debajo incluso del más barato DeepSeek V4.1 Flash. Musk había corrido la fecha al menos cinco veces desde fines de julio. Está en la app de Grok, en Cursor, en Grok Build, en la API y desde hoy en GitHub Copilot. The Decoder · Decrypt · GitHub Changelog
The Decoder Decrypt GitHub Changelog DeepSeek GitHub Claude Grok GitHub Copilot
-
CISA, la NSA y el FBI acusaron a seis empresas chinas de destilar los modelos frontera estadounidenses a escala industrial (09/09)
El aviso conjunto nombra a DeepSeek, Moonshot AI, Alibaba, MiniMax, StepFun y Z.AI, y sostiene que desde fines de 2024 extrajeron miles de millones de tokens con millones de pedidos a los modelos de Anthropic, OpenAI, Google y xAI. Las agencias evalúan que la escala y la sofisticación implican conocimiento del gobierno chino y que la práctica es parte central de la estrategia de desarrollo de esas empresas. La mecánica descrita es la de una operación armada: pedidos repartidos entre cuentas fraudulentas o compartidas, servicios cloud, agregadores y proxies "estación de transferencia" para saltar restricciones geográficas y límites de uso; prompts que buscan sacar cadenas de razonamiento restringidas; failover automático entre rutas cuando una se bloquea; y frameworks de evaluación de calidad para detectar si el proveedor empezó a degradar las respuestas a propósito. DeepSeek y Moonshot figuran como los principales, seguidos por MiniMax. BleepingComputer · CISA
BleepingComputer CISA OpenAI Anthropic Google DeepSeek Moonshot AI Alibaba CISA
-
El Pentágono suma ChatGPT Mil y Grok for Government al portal GenAI.mil, que ya tenía Gemini (31/08)
GenAI.mil arrancó en diciembre con Google Gemini y ahora incorpora versiones a medida de los productos de OpenAI y xAI, disponibles para los más de 3 millones de personas —civiles y militares— del Departamento de Defensa. La plataforma lleva 1,7 millones de usuarios únicos en nueve meses. El punto técnico que justifica el portal es el aislamiento: los datos procesados en GenAI.mil se quedan dentro del entorno del gobierno y no se usan para entrenar ni mejorar los modelos públicos de los proveedores, que es exactamente lo que pasaría si cada empleado usara la versión de consumo por su cuenta. La otra lectura es de mercado: los tres laboratorios grandes de Estados Unidos quedaron adentro del mismo contrato marco, sin exclusividad. TechCrunch · DefenseScoop
-
SpaceX va a fabricar sus propios álabes y paletas de turbina para destrabar los generadores a gas de los datacenters de xAI (30/08)
Musk lo anunció en X: el cuello de botella para producir turbinas de gas natural es el fundido de los álabes y las paletas, y por eso SpaceX se lo trae adentro. El contexto es el de siempre —la conexión a la red eléctrica tarda años, así que los proyectos de datacenter recurren a generadores de turbina portátiles, del tamaño de un tráiler, para arrancar antes—, y esa demanda repentina chocó contra una industria de motores a reacción que ya venía escasa por sus propios problemas de cadena de suministro. Un lote de álabes puede tardar entre 60 y 90 semanas: son piezas sometidas a fuerzas y temperaturas extremas, y la precisión que exigen no baja porque el motor esté atornillado al piso en vez de colgado del ala de un avión. Musk dice que la movida recorta 18 meses de espera frente a una cola que se estira hasta 2030. También aclaró que SpaceX y Tesla siguen construyendo 100 GW/año de capacidad solar cada una, pero que "el gas natural va a seguir siendo necesario para suplementar y arrancar la solar durante varios años". Tom's Hardware
-
Los chatbots mandan a embarazadas a sitios antiaborto sin aclarar de qué se trata (24/08)
Una investigación de AlgorithmWatch probó ChatGPT-5, Gemini 3, Grok 4.3 y Claude Sonnet 4.8 con tres personas ficticias en inglés, alemán e italiano, y juntó 270 respuestas: en al menos una de cada cuatro consultas apareció un link a una web antiaborto sin distinguirla de una autoridad sanitaria oficial. La organización Profemina, ligada a Heartbeat International, salió en cerca del 17% de todas las respuestas, y en las consultas que pedían testimonios personales llegó al 33% en alemán y 29% en italiano. Hay dos comportamientos que valen aparte: Gemini enlazó a Profemina cinco veces en una misma conversación, compartió un gráfico de su web y después advirtió contra esa misma fuente; Claude hizo algo parecido. El caso alemán es el más concreto en daño: en once de doce conversaciones los modelos recomendaron Caritas para el asesoramiento previo obligatorio, y Caritas no emite el certificado que la ley alemana exige para abortar dentro de las doce semanas, así que quien va ahí primero pierde tiempo del plazo. Google y OpenAI remitieron a sus políticas, que no cubren el tema; Anthropic y xAI no contestaron. The Decoder · AlgorithmWatch
The Decoder AlgorithmWatch OpenAI Anthropic Google Claude Gemini Grok
-
Ninguna empresa de IA aplica controles básicos a sus propios sistemas internos, y la mejor nota es un C+ (19/08)
Es la primera evaluación de Guidelight, una organización sin fines de lucro fundada por los ex responsables de seguridad de OpenAI Page Hedley y Steven Adler, que miró a Anthropic, OpenAI, Google, xAI y Meta usando solo fuentes públicas: system cards, reportes de seguridad y posteos de blog. Chequearon seis prácticas básicas, entre ellas registrar la actividad de la IA interna, pasar las acciones riesgosas por un mecanismo de revisión, apagados de emergencia —los "circuit breakers"— y planes para contener modelos desalineados. Anthropic y OpenAI encabezan con C+, Google sigue con D+ y una hoja de ruta detallada, xAI saca D− y Meta reprueba con F. El patrón es consistente entre empresas: rinden bien detectando comportamiento indebido y mal previniéndolo o conteniéndolo. Vale leerlo junto al ítem de arriba: los labs corren agentes de forma continua contra sus propios sistemas de producción antes de tener los controles escritos. The Decoder · Guidelight
-
Musk: xAI multiplicará por 7 su capacidad de datacenter para 2027
El 13 de agosto Elon Musk puso como objetivo 10 gigavatios de cómputo y hasta $500.000M de ingresos para fines del año que viene. Tomarlo con pinzas — son proyecciones, no compromisos verificables — pero marca la escala a la que se está compitiendo por energía y silicio. En la misma línea, AMD tomó deuda por $4.750M el 14 de agosto "para fines corporativos generales", sin explicar el destino. Tom's Hardware (xAI) · Tom's Hardware (AMD)
-
xAI/SpaceXAI lanzó Grok 4.6, su nuevo flagship para agentes
Modelo con contexto de 500K tokens, entrada de texto e imagen, y RL sobre entornos agénticos (coding, kernel optimization, web dev, CAD). Empata a GPT-5.6 Sol y supera a Kimi K3 en el Intelligence Index de Artificial Analysis (61 puntos, +5 vs. Grok 4.5), a US$2/M input y US$6/M output. VentureBeat · MarkTechPost
-
xAI lanza Grok Imagine Video 1.5 con texto-a-video nativo en 1080p
El 1 de agosto xAI actualizó su generador de video sumando 1080p nativo tanto desde texto como desde imagen, hasta siete imágenes de referencia para consistencia de personajes/entornos y hasta tres inputs de audio para consistencia de voz entre escenas. Ya está disponible en web, mobile y la API, arrancando por los planes SuperGrok Heavy y Plus en EE.UU. (cryptobriefing.com)
-
OpenAI abarata GPT-5.6 hasta 80% y regala acceso frontier a investigadores
OpenAI bajó el precio de sus dos modelos GPT-5.6 más económicos, con GPT-5.6 Luna cayendo a 20 centavos por millón de tokens de entrada, y por separado dio acceso gratuito a sus modelos frontier a unos 100.000 investigadores hasta 2027. Es un movimiento agresivo de precio y adopción en plena guerra de modelos con Anthropic, Google y xAI. Tech Startups · ThursdAI
-
Grok Build (xAI) — agente de coding open-source
xAI liberó el CLI/TUI que corre el mismo loop de agente detrás de su stack de coding. Suma a la ola de "harnesses" de agentes que domina GitHub este mes (junto a bytedance/deer-flow para tareas de largo horizonte). Vale probarlo si estás armando scaffolding de agentes de coding. Analytics Vidhya
-
OpenAI abre ChatGPT for Small Businesses
OpenAI anunció el 21 de julio un programa orientado a pymes, ampliando su estrategia de monetización más allá de Enterprise y del consumidor. En paralelo, la industria sigue caliente: julio acumuló más de dos docenas de lanzamientos de modelos entre OpenAI, Anthropic, Google, Meta y xAI. buildfastwithai · ThursdAI
-
Google lanza Gemini 3.6 Flash (21/07)
Google puso a disposición Gemini 3.6 Flash, su modelo rápido de nueva generación, sumándose a una temporada intensísima: en el último mes también se publicaron Claude Sonnet 5 (Anthropic), GPT-5.6 —dividido en tres modelos: Sol, Terra y Luna (OpenAI)— y Grok 4.5 (xAI). El ritmo de lanzamientos entre labs sigue acelerando. llm-stats · ThursdAI
llm-stats ThursdAI OpenAI Anthropic Google GPT Claude Gemini Grok
-
AI Safety Index 2026: Anthropic a la cabeza, varios reprueban
El Future of Life Institute publicó su índice anual de seguridad: Anthropic obtuvo la nota más alta (C+), OpenAI y Google DeepMind quedaron en C, Meta en D+, y xAI, DeepSeek y Mistral esencialmente reprobaron. El informe señala que varios labs habrían retrocedido en compromisos de seguridad previos. ThursdAI
ThursdAI OpenAI Anthropic Google Google DeepMind Meta DeepSeek Mistral
-
Musk confirmó Grok 4.6, de 2T de parámetros, para responderle a Kimi
El 18 de julio Elon Musk confirmó Grok 4.6, un modelo frontier de 2 billones de parámetros que terminó su pre-entrenamiento inicial la semana del 20 de julio. La apuesta de xAI es igualar o superar a Kimi K3 manteniendo la velocidad y eficiencia de tokens del Grok 4.5 (lanzado el 8 de julio, que ya superaba a Opus 4.8 y Fable en SWE Marathon). Inshorts · kie.ai
-
xAI/SpaceXAI pone a Grok 4.5 como "clase Opus" a menor costo
Anunciado el 8/07 y disponible esta semana, Grok 4.5 fue entrenado junto a Cursor sobre decenas de miles de GPUs NVIDIA GB300. Musk lo describe como "clase Opus, pero más rápido, más eficiente en tokens y más barato", a US$2/US$6 por millón de tokens (input/output) frente a US$5/US$25 de Opus 4.8. TechCrunch · Axios
-
xAI presenta Grok 4.5
xAI anunció Grok 4.5, su modelo más avanzado, orientado a coding, tareas agénticas y trabajo de conocimiento. Corre a 80 tokens/segundo, dice superar a Opus 4.8 en benchmarks clave como DeepSWE 1.0 y ofrece el doble de eficiencia de tokens a $2/M input y $6/M output. El precio y la velocidad lo posicionan como una opción de bajo costo para cargas agénticas. BuildFastWithAI
-
Grok 4.5: xAI se mete en la pelea de coding con eficiencia de tokens como argumento
xAI lanzó Grok 4.5, entrenado sobre decenas de miles de GB300 de Nvidia y —según la empresa— junto a Cursor. En los benchmarks propios queda por debajo de Fable y GPT-5.5 en la mayoría de las pruebas de coding (DeepSWE, SWE-Bench Pro), pero clava Terminal Bench 2.1 en 83,3%, prácticamente empatado con GPT-5.5. El dato que xAI empuja fuerte es el consumo: reporta ~15.954 tokens de salida promedio en SWE-Bench Pro contra ~67.020 de Opus 4.8, una brecha de 4,2x. Advertencia obligatoria: son números autoreportados, sin verificación independiente todavía. x.ai · Axios · The Decoder
-
xAI saca Grok 4.5, "clase Opus" y más barato
El 8 de julio xAI lanzó Grok 4.5, su primer modelo orientado específicamente a coding y trabajo agéntico, entrenado con datos reales de sesiones de Cursor sobre una base V9 de 1,5 billones de parámetros. Queda cuarto en el Artificial Analysis Intelligence Index —por encima de todo modelo open-weight y de los Gemini— a un precio de US$2/US$6 por millón de tokens, ~60% más barato que Opus 4.8 o GPT-5.5. Todavía no está disponible en la UE (previsto para mediados de julio). x.ai · Axios · Yahoo Tech
-
xAI publica Grok 4.5
Grok 4.5 salió el 8 de julio de 2026, siendo el modelo más reciente al momento del relevamiento. Su aparición, casi en paralelo con GPT-5.6 y con la Claude Sonnet 5 de Anthropic (30 de junio), confirma que el ritmo de releases frontera se comprimió a cuestión de días. llm-stats · pricepertoken
-
Intel se suma al proyecto Terafab de Musk
Intel anunció una alianza con Terafab —joint venture que involucra a Tesla, SpaceX y xAI— que requiere sus nodos 18A y futuros para producción de chips de IA en alto volumen. Es un movimiento significativo para la relevancia de Intel Foundry y para diversificar la cadena de suministro de aceleradores frente al dominio de Nvidia. Distill Intelligence
-
Grok 4.5 en beta privada; xAI abre su Voice Agent Builder
Elon Musk confirmó (28 de junio) que Grok 4.5 está en beta privada con equipos de SpaceX y Tesla, construido sobre una nueva base "V9" de ~1,5 billones de parámetros, aunque sin fecha pública de lanzamiento; Grok 4.3 sigue siendo el flagship abierto. En paralelo, xAI lanzó en beta Voice Agent Builder, una plataforma no-code para crear agentes de voz de producción sobre Grok Voice. Releasebot — xAI · llm-stats
-
Intel: participación del 10% del gobierno de EE.UU. y alianza con Terafab
Se reportó que el presidente Trump se atribuyó una participación accionaria del 10% en Intel como triunfo para el sector de semiconductores de EE.UU., mientras Intel inició obras de un nuevo hub de manufactura en Santa Clara. Además, Intel anunció una alianza con el proyecto Terafab (joint venture de Tesla, SpaceX y xAI), que requiere sus nodos 18A y futuros para producción de chips de IA en alto volumen. Distill Intelligence