Y por supuesto, Marcus dándose prisa en declarar que "la IA no puede" antes de que OpenAI le demostrara que, una vez más, se volvía a equivocar. Rápido, a mover de nuevo la portería!
LLMS
-
New AI Models and Capabilities Discovered Unexpectedly
By
–
Ni idea, hasta hace un par de horas ni sabíamos que estos nuevos modelos existían ni que estas capacidades eran posibles
-
Training Data Curation vs AI Model Reasoning Capability
By
–
For special purpose models, fully curated training data and thought patterns are the obvious way to go, but models that are meant to seriously help you think will either be able to infer dangerous ideas from incomplete data or they will be useless
-

AI Mathematical Capabilities Predictions 2021-2025 Analysis
By
–
Y esto último también mola. De esta estimación me acuerdo, cuando en 2021 se le pidió a varios investigadores que estimaran dónde estarían las capacidades de la IA en matemáticas en 2025. Muchos estimaron que la IA por estas fechas podría resolver un 50% de las tareas del
-

Reinforcement Learning Challenges Training Complex AI Reasoners
By
–
El uso de RL para entrenar a los razonadores actuales encontraba el problema de que para problemas muuuuy complejos que requieren mucho tiempo para resolverlos y verificar que estaban correctos (y darle feedback a la IA de que lo ha hecho bien o mal para mejorar su
-
New AI Model Demonstrates Advanced Mathematical Capabilities Beyond GPT-5
By
–
De hecho ni siquiera estamos hablando de un próximo GPT-5 con este nivel de matemáticas. Se trataría de otro modelo diferente entrenado para esta hazaña. Muy prometedor saber que hay mucho más recorrido por delante en las capacidades de los modelos
-
Advanced AI Techniques Discoveries Coming in Upcoming Months
By
–
Ojo que no estamos hablando de resultados logrado con los modelos que tenemos actualmente (o3, o4-mini, …) sino el resultado de nuevas técnicas más avanzadas que nos irán descubriendo en los próximos meses.
-
Grok evolves from a tool to a collaborative AI team
By
–
Academic summarizer to whitepaper writer to UX reviewer. Grok is starting to feel like a real team, not just a tool.
-
AI Achieves Breakthrough on IMO Mathematical Problems
By
–
Wild progress since 2022, when we achieved our first results on any IMO problem:
-
General RL approach with test time compute scaling breakthrough
By
–
What’s most remarkable is that this system uses a very general approach, using reinforcement learning and scaling of test time compute:
