También han presentado nuevas voces para Grok que la verdad suenan muy muy naturales! Ganas de escucharlo hablar en español. Además han ido a hacer daño comparando con ChatGPT en directo 🙂
LLMS
-
Scale, Tool Use, and Multimodal: AI Development Path Forward
By
–
It looks like scale + tool use + multimodal remains the chosen path forward.
-

o3 vs Grok 4 benchmark comparison guide
By
–
Más benchmarks. Recordatorio que para hacer la comparación justa tenéis que comparar: o3 -> Grok 4
o3 pro (no aparece) -> Grok 4 Heavy -

Grok 4 Heavy Achieves 44.4% on HLE Benchmark
By
–
Esta sería la photo finish en el benchmark de HLE con todas las preguntas (text-only y multimodales) donde Grok 4 Heavy alcanza un sorprendente 44.4% Por comparar manzanas con manzanas, el salto entre Gemini 2.5 Pro (SOTA previo) y Grok 4 es de +11% y es una locura!
-

Grok 4 Heavy Demonstrates Compute-Centric AI Progress
By
–
Insane rate of progress Grok 4 heavy is nuts This proves that compute is all you need AI infrastructure is the most important thing to be building
-

Powerful AI Demos Missing Accessibility and Public Understanding
By
–
Aquí la parte que mejor ilustra el "problema" actual de las IAs tan potentes que recibimos: demostrar lo inteligentes que es la IA con problemas que la mayoría de mortales ni entendemos. En muchos casos ni los propios presentadores entienden
-

Grok 4 Heavy multiagent system achieves 50.7% on HLE
By
–
Ojo que ejecutado en paralelo dedicando más computación se meriendan la mitad de preguntas del HLE, con un 50.7% !!! La versión multiagente es la que se podrá usar en la versión más cara de Grok, llamada Grok 4 Heavy


