Le he pedido a Sora que genere "something sexy" pic.twitter.com/d9QSZoYG0g
— Carlos Santana (@DotCSV) 30 septembre 2025
Le he pedido a Sora que genere "something sexy"
By
–
Le he pedido a Sora que genere "something sexy" pic.twitter.com/d9QSZoYG0g
— Carlos Santana (@DotCSV) 30 septembre 2025
Le he pedido a Sora que genere "something sexy"
By
–
Le he pedido a Sora que genere una captura de pantalla de alguien navegando en internet buscando un vídeo de DotCSV en Youtube.
— Carlos Santana (@DotCSV) 30 septembre 2025
Es curioso porque no conoce mi apariencia, pero sí la temática del canal y joer, hasta la voz me suena un poco parecida 😮 pic.twitter.com/Vq7q4hsMhQ
Le he pedido a Sora que genere una captura de pantalla de alguien navegando en internet buscando un vídeo de DotCSV en Youtube. Es curioso porque no conoce mi apariencia, pero sí la temática del canal y joer, hasta la voz me suena un poco parecida
By
–
Bastante loco que Sora se permita generar contenido con copyright, por ahora https://
x.com/fofrAI/status/
/fofrAI/status/1973142810405597535
…

By
–
Bueno, y ya puestos a pedir también quiero ver su posición en el nuevo GDPval donde Anthropic con Opus 4.1 se lleva el oro!
By
–
De hecho tengo ganas de ver dónde se coloca Sonnet 4.5 en la gráfica de METR de la que os hablaba en mi último vídeo. Ese tipo de benchmarks sí que son interesantes 🙂

By
–
There's a bit of a weird trend of bragging about how many hours a model can work autonomously (Codex 7 hours, Sonnet 30 hours…) but if there's no comparison to how many hours of human work that task it solves is equivalent to, it doesn't make much sense. I mean, I could also

By
–
En cualquier caso, como siempre, a estos modelos hay que saborearlos y la mejor forma es dentro del nuevo Claude Code 2.0 (que de novedad ahora incluye checkpoints !!) y ver si con eso vuelven a convencer a parte de la comunidad que había migrado a Codex en las últimas semanas.

By
–
Aparte veo interesante la subida en Computer Use (OS World) frente a Opus 4.1, en matemáticas y finanzas.

By
–
En capacidades agénticas, que es donde estos modelos tienen un mayor impacto cuando se orquestan con el uso de herramientas o integrándose en Claude Code, Sonnet logra ahora un nuevo record em SWE-bench Verified, con un 77,2% Parece poco, pero estas pequeñas ganancias importan!

By
–
¡CLAUDE SONNET 4.5 YA ESTÁ AQUÍ! Los de Anthropic mueven ficha y saltan a la versión 4.5 con su nuevo Sonnet, que según indican, es el mejor modelo del mundo para programar! ¿Es esto cierto? En los benchmarks se ve un buen salto en capacidades!