Claro, me refiero a que si ya los LLMs autorregresivo son impresionantes, estos métodos no autorregresivos además de ser impresionante se me antojan super poco intuitivos.
GENERATIVE AI
-

Diffusion Models Generate Code Non-Sequentially Like Impressive Breakthrough
By
–
Ver a una IA de forma autorregresiva generando código (secuencialmente, token tras token) ya era impresionante.
— Carlos Santana (@DotCSV) 24 juillet 2024
Pero ver métodos similares a los modelos de difusión generando trozos de código y llegando a una solución, además de impresionante ya me parece anti-intuitivo 😯 https://t.co/J3dFfUaP6pVer a una IA de forma autorregresiva generando código (secuencialmente, token tras token) ya era impresionante. Pero ver métodos similares a los modelos de difusión generando trozos de código y llegando a una solución, además de impresionante ya me parece anti-intuitivo
-
Celebrating open-source contributions to AI development
By
–
Thanks for all your work @Thom_Wolf
, open-source was a good bet! 🙂 -
Llama 3.1 Performance Benchmarks Compared to Sonnet and GPT-4o
By
–
El gráfico, aunque sólo se base MMLU, es consistente con las evaluaciones en el resto de benchmarks donde Llama 3.1 alcanza a Sonnet 3.5/GPT-4o, así que las conclusiones sí me parecen validas. Respecto al open source, efectivamente, estrictamente hablando, no lo es y encajaría
-
Meta’s Next Generation AI Models: Resources and Release Strategy
By
–
Todo depende de qué tan alto sea el escalón de la próxima generación de modelos. Lo que está claro es que Meta cuenta con el talento y los recursos para seguir la estela. Sólo falta que sigan conservando la voluntad de liberar modelos cada vez más potentes.
-
ChatGPT’s Rapid Impact: Less Than Two Years Later
By
–
Sorprende pensar que no han pasado ni 2 años desde la salida de ChatGPT.
-
OpenAI versus Llama: Can competitors keep pace with Meta’s open model?
By
–
¿Aguantarán, OpenAI y competidores, meses sin elevar las capacidades de sus modelos mientras la Llama sigue libre? ¿Encontraremos benchmark más difíciles que diferencien las capacidades de los modelos actuales y de los que están por venir? ¿Se dejará Zuckerberg barbita para
-

Generative AI Was More Enjoyable Before Recent Developments
By
–
Generative AI with all its imperfections was more fun a few years ago
-

Bilingual Foundation Models Presented at ICML 2024
By
–
Attend our presentation at #ICML 2024 in Vienna, Austria! Yishu Xu and Gokul Ramakrishnan will present our accepted paper, "Bilingual Adaptation of Monolingual Foundation Models Presentation at the ICML 2024 Workshop on Foundation Models in the Wild In collaboration with G42,
-

GPT-4o-mini Rankings and Model Alignment Methods Evaluation
By
–
Knowing the great people behind lmsys, I don't think there is anything really fishy in the gpt-4o-mini ranking like some people have been saying Likely more of a symptom that as models (and alignement methods) are getting much better it's been harder and harder to tell models