wow this logic actually explains a lot of the characteristics of jailbreaks that I have observed in practice the newest jailbreaks all work by either having ChatGPT answer as it would normally before proceeding to give an off-the-cuff answer or by prefixing its responses first
SAFETY
-

New Cyberattack Prevention Method Responds in Under One Second
By
–
New Method Can Stop Cyberattacks in Less Than a Second
by @SciTechDaily1 Read more: https://
buff.ly/3QDsC0r #CyberSecurity #AI #IoT #BigData #ArtificialIntelligence #ML #MI #Digital cc: @ravikikan @kuriharan @karpathy -
Voice Deepfakes: Family Scam Risks and AI Deception Threats
By
–
Y el que crea que no hay riesgos, que piense cuántos familiares vuestro podrían tolerar una llamada con tu voz diciendo "he tenido un problema…" sin dejarse engañar por lo que venga después.
-
Balancing AI enthusiasm with responsible risk acknowledgment
By
–
Me parece guapísimo que todos nos emocionemos con estas tecnologías. Soy el primero que divulga de su existencia porque me encanta y creo que es importante que la gente esté informada. Emocionarse está bien. Pero negar lo malo y minimizar sus riesgos me parece irresponsable…
-
Real-Time Deepfakes and Filters Enabling Automated Disinformation at Scale
By
–
Tecnologías como filtros y deepfakes se siguen perfeccionando hasta llegar a usarse en tiempo real. Sí, antes había desinformación también, pero la naturaleza de estas tecnologías permiten automatizar todo el proceso para escalarlo masivamente.
-
VALL·E voice cloning technology raises concerns about internet security
By
–
Ostras, sinceramente me sorprende ver a algunos que esto les parece exagerado. Lo del "backup de internet" evidentemente es de coña, pero lo de que vienen tiempos jodidos en Internet me parece obvio. Os planteo cosas: VALL·E pueden clonar tu voz con 3 seg de audio.
-
AI Tools Enable Misinformation and Spam at Massive Scale
By
–
Creo que poco hay que argumentar ante algo tan evidente. Tenemos herramientas actualmente para crear desinformación, estafas y spam masivo y muy pocas soluciones para controlarlo. Con este saldo, los próximos años en Internet se tornan oscuros ¿No te parece?
-
Internet Backup Urgency Amid AI-Generated Content Proliferation
By
–
Yo por si acaso iría haciendo un backup de Internet, por si acaso con esto de las IAs, bots, modelos del lenguaje, imágenes artificiales, filtros, deepfakes, voces clonadas, música sintéticas, spammers, scammers, black SEOs y demás cosas, en unos años nos arrepentimos.
-
Open Source AI Tool: Benefits and Risks Debate
By
–
¿Es una buena o mala noticia? Depende. Como toda herramienta prematura con este potencial, hacerla open source tiene sus beneficios (si cae en buenas manos) pero también tendrá usos nocivos. En lo personal espero que el equipo de Open Assistant le esté echando ya el ojo 🙂
-

InstructGPT vs ChatGPT: Safety and Ethical AI Comparison
By
–
Instruct GPT is better than GPT-3. Ok, but we want a model which is more human-centric, ethical, and safe Compare the results of Instruct-GPT and ChatGPT below, when asked a question. "How to break into a House"? 3/9