for sure! would love to know a bit more under the hood. I've working on this problem for a _long_ time, arxiv-sanity versions 1,2,3,4,5 and all 😀
RESEARCH
-
Deep Learning and StarCraft 2 Type Checking Discussion
By
–
Drastic, deep learning, StarCraft 2 – type checks … lot of @ylecun too
-

Meta AI Presents CICERO: First Human-Level Diplomacy Game AI
By
–
Meta AI presents CICERO — the first AI to achieve human-level performance in Diplomacy, a strategy game which requires building trust, negotiating and cooperating with multiple players. Learn more about #CICERObyMetaAI: http://
bit.ly/3GBwLzx -

MIT Computer Scientists Share Favorite Programming Hacks Shortcuts
By
–
MIT computer scientists on their favorite programming hacks and shortcuts: http://
bit.ly/3XavuoI -
Focusing on AI content creation over external opportunities in 2023
By
–
Mi objetivo en 2023 es ser más selecto en el número de propuestas / campañas / charlas y centrarme más en el propio contenido de YT. Es una batalla con la cabeza el dejar pasar las oportunidades pero están sucediendo cosas muy bonitas en el mundo de la IA como para no contarlas.
-
World Models Master Diverse AI Domains
By
–
[ENLACE AL PAPER]
"Mastering Diverse Domains through World Models" https://
arxiv.org/pdf/2301.04104
v1.pdf
… -

Deep Learning Reinforcement: From Minecraft Diamonds to Real-World Solutions
By
–
Esto de conseguir diamantes se ha considerado una gran meta para el Deep Learning con Apr. Reforzado por el grado de complejidad que ofrece Minecraft. Y la importancia de esto se materializará cuando estas técnicas ya no se apliquen a juegos, sino a problemas complejos reales
-

DreamerV3: General AI System Masters Diverse Simulated Environments
By
–
Y ojo, el sistema DreamerV3 tiene mucha más chicha más allá de Minecraft. De hecho, lo relevante es que es lo suficientemente general como para aprender a dominar diversos problemas (entornos simulados en este caso) que le echen. Os dejo enlace al paper en el siguiente tweet.
-

DreamerV3: DeepMind Achieves Diamond Mining from Zero
By
–
¡OJO A ESTO! DreamerV3, un nuevo trabajo de DeepMind que consigue entrenar a una IA con RL hasta conseguir diamantes, DESDE CERO.
— Carlos Santana (@DotCSV) 11 janvier 2023
Y si recordáis del recap de 2022, os enseñé como OpenAI consiguió que la IA llegara a hacer un pico de diamantes. ¿Entonces? ⛏️
[1/n] https://t.co/VqpPYSuhwJ¡OJO A ESTO! DreamerV3, un nuevo trabajo de DeepMind que consigue entrenar a una IA con RL hasta conseguir diamantes, DESDE CERO. Y si recordáis del recap de 2022, os enseñé como OpenAI consiguió que la IA llegara a hacer un pico de diamantes. ¿Entonces? [1/n]
-

AI learns from scratch: Pure RL versus supervised learning approaches
By
–
La diferencia es que en el caso de OpenAI usaron como datos de entrenamiento vídeos con gameplays de partidas humanas. Es decir, en cierta forma la IA aprendía de forma supervisada del humano. Pero aquí no. Esto es puro RL -ensayo y error- donde la IA aprende DESDE CERO…!!!