AI Dynamics

Global AI News Aggregator

About

Benchmarking Gemma 4 and 26B AI Models on NVIDIA RTX 5090

Pour ceux que ça intéresse, j’ai lancé un benchmark sur ma NVIDIA RTX 5090 avec une utilisation "normale" de l'ordinateur en parallele sur Gemma 4. Je suis à 285.29 tokens par seconde sur Gemma 4 E2B en 4 bits. Quelle folie quand même. Et le 26B en 8 bits tourne à 166.75

→ Voir le post original sur X — @dfintelligence