No, significa que muchas cuentas de Twitter, y parece que te incluyes en ese grupo, no entienden lo que ese benchmark mide. Aquí te lo explican para que entiendas de lo que hablo en el tweet
@dotcsv
-
Controlling AI-Generated Content Distribution and Open Source Models
By
–
Puesto que no todas las formas de generar contenido con IA podrá controlarse (e.g. modelos open source), no todo el contenido podrá ser marcado criptográficamente y parte del problema seguirá existiendo. Habría que controlar el canal por donde se distribuye y quién, pero eso es
-
Unrealistic AI Hype and Follower Disappointment Cycles
By
–
Se sobre-emocionan ante la expectativa de algo que no tiene sentido, y luego se sobre-decepcionan cuando esas expectativas falsas no se cumplen. Y con ellos sus seguidores.
-

AI Influencers Misunderstand METR Benchmark Results for Sonnet
By
–
The number of AI influencers who are surprised that Sonnet 4.5 didn't achieve a better position on the METR benchmark, when they were saying it "could work autonomously for 30 hours," worries me. They're not understanding anything about what these benchmarks measure. They're
-

Gemini 2.5 Deep Think Sets New Frontier Math Record
By
–
Gemini 2.5 Deep Think consigue un nuevo record en Frontier Math, evaluado por la buena gente de Epoch
-

Sonnet 4.5 vs GPT-5: METR benchmark autonomous work hours
By
–
Sonnet 4.5 aparece en la gráfica de METR colocándose en la línea de tendencia pero sin superar al punto más alto, ocupado por GPT-5, en este benchmark que mide el equivalente de horas de trabajo humano que un LLM puede resolver de forma autónoma.
-

GPT-5 Pro Achieves Top Results on ARC-AGI Benchmarks
By
–
Un par de actualizaciones a benchmarks interesantes que estábamos esperando. GPT-5 Pro en ARC-AGI 1 y 2 logra ser el LLM disponible que mejores resultados consigue en ambos benchmarks.
-
Local open source models enable precise scene lighting control
By
–
Bastante guapo el control que se puede tener de la iluminación de una escena usando únicamente modelos open source en local 🔥 https://t.co/KtooJszgJU
— Carlos Santana (@DotCSV) 9 octobre 2025Bastante guapo el control que se puede tener de la iluminación de una escena usando únicamente modelos open source en local
-
Robots Making Real Progress Despite Long Development Timeline
By
–
Están llegando, pero a lo mejor les quedan bastantes kilómetros por recorrer Estoy de acuerdo en que llevamos mucho tiempo con muchas promesas, peeeero, los 2-3 últimos años sí ha habido algunos avances claves que hacen que los robots más allá de ser un cascarón muy chulo,
-
Domestic robots predictions coming true soon
By
–
Cuidao @antor que al final tendrás razón con tus predicciones de cuándo tendrás un robot doméstico en casa 🙂