No negaré que este pensamiento ha venido después de actualizar mis Pico4 y ponerme a pasear por toda la casa con el pass-through activado flipando en colorines.
@dotcsv
-

VR for 3D Human Motion Data in Humanoid Robot Training
By
–
¿Y si el interés tras el VR fuera el de obtener datos etiquetados del movimiento del cuerpo humano en 3D para distintas tareas, y usarlo para el entrenamiento de futuros robots humanoides?
-

Community Projects Enhance Whisper Speech Recognition Capabilities
By
–
Desde que salió Whisper hay proyectos paralelos de la comunidad mejorando lo que puede hacer.
— Carlos Santana (@DotCSV) 30 janvier 2023
Funcionalidades como darte timestamps a nivel de caracteres, mejor detectores de voz (VAD) o diferenciación de voces, son algunas de las características🔥
Echadle un ojo y a construir! https://t.co/oNjg7E4X18Desde que salió Whisper hay proyectos paralelos de la comunidad mejorando lo que puede hacer. Funcionalidades como darte timestamps a nivel de caracteres, mejor detectores de voz (VAD) o diferenciación de voces, son algunas de las características Echadle un ojo y a construir!
-
Multi-concept AI training models sacrifice quality for versatility
By
–
Sí es cierto que los nuevos modelos que permiten hacer entrenamiento de múltiples conceptos (varias personas u objetos), para poder hacer eso, han sacrificado calidad. Pero lo repasaré, porque creo que podemos volver a las versiones anteriores, de un único sujeto con calidad.
-
Defining True AI: Current Definition Versus Reality
By
–
Por entender tu punto de vista entonces ¿cuál es la definición correcta de inteligencia artificial y en qué difiere a lo que actualmente se llama "inteligencia artificial"?
-
AI Music Generation Without Vocals for Video Content
By
–
En mi caso para mis vídeos siempre busco música sin voz (incluso en Epidemic Sound) así que no sería uno de mis casos de uso. AAAAAUNQUE siempre molará ver algo así 🙂
-
AI Music Generation Service for YouTube Video Production
By
–
El servicio de música para los vídeos de YT que ahora mismo pago a través de un Epidemic Sound, pero con mayor flexibilidad de poder ajustar el estilo a lo que busco, duración, etc. En definitiva reducir tiempos de búsqueda de la canción perfecta, generándola directamente.
-

Google Project Conditions AI Models on Melodies and Text
By
–
Súper interesante el poder condicionar no sólo a texto, sino también a MELODÍAS.
— Carlos Santana (@DotCSV) 27 janvier 2023
Pe-pero Carlos… ¿y se puede utilizar?
A ver, no habéis visto que he dicho que el proyecto era de Google… 😅 pic.twitter.com/p7p0xyADBTSúper interesante el poder condicionar no sólo a texto, sino también a MELODÍAS. Pe-pero Carlos… ¿y se puede utilizar? A ver, no habéis visto que he dicho que el proyecto era de Google…
-
Google’s Text-to-Music AI Project Shows Promising Results
By
–
🔴 ¡GENERACIÓN MUSICAL CON IA!
— Carlos Santana (@DotCSV) 27 janvier 2023
Cada 1-2 semanas aparece un nuevo proyecto de Text-to-Music, generación de música con texto, acercándonos cada vez más a un producto funcional.
Este nuevo proyecto de Google tiene unos cuántos ejemplos bastante prometedores! https://t.co/qEFTPsq92s¡GENERACIÓN MUSICAL CON IA! Cada 1-2 semanas aparece un nuevo proyecto de Text-to-Music, generación de música con texto, acercándonos cada vez más a un producto funcional. Este nuevo proyecto de Google tiene unos cuántos ejemplos bastante prometedores!
-

LoRA enables lightweight fine-tuning for Stable Diffusion models
By
–
Recordáis eso de enseñar nuevos conceptos a Stable Diffusion y que te saliera un modelo 2GB? Los resultados eran espectaculares, pero tener un modelo de ese tamaño por cada concepto pues meh. Pues ahora LoRA permite hacer eso, calidad similar, pero generando ficheros de 3.3 MB!