It’s practical for private deployments on <2 GPUs. Customers can optimize compute usage through a user-controlled token budget, offering fine-grained control over latency and performance for your applications.
LLMS
-

Private AI Model Surpasses Benchmarks for Global Enterprises
By
–
It surpasses other privately deployable models in its class across key agentic and multilingual benchmarks to unlock real value for global enterprises.
-

Command A Reasoning: Advanced Enterprise AI Model Launch
By
–
Introducing Command A Reasoning, our most advanced model for enterprise reasoning tasks.
-
Weekly AI digest: Prompt injections, open-source models, and development tools
By
–
Sent out my weekly-ish newsletter – this edition covers the latest prompt injections, gpt-oss, GitHub Codespaces, Gemma 3 270M, Qwen-Image-Edit and how congress. gov uses XSLT! https://
simonw.substack.com/p/prompt-injec
tions-as-far-as-the-eye
… -
Comparing Gemini and ChatGPT beyond simple chatbot classification
By
–
People keep comparing Gemini to ChatGPT like it’s just another chatbot.
-
Gemini demonstrating advanced strategic reasoning capabilities
By
–
Gemini is getting scary good at strategy level tasks. Not just summaries and rewrites anymore.
-
Reasoning Models Token Price Beyond Surface Analysis
By
–
De la gráfica anterior hay que tener en cuenta que hablamos del precio por token, y sabemos que los modelos razonadores exprimen sus capacidades generando más tokens… así que bueno, tomad la parte del precio como un indicador pero que no cuenta la historia completa.
-

AI Model Power Increases While Costs Decrease Year-Over-Year
By
–
Por visualizar el cuadrante inteligencia vs precio, el punto que marco es el modelo más potente que teníamos hace justo un año. Todos los demás, más baratos, más potentes… es lo que se ha logrado en los último 12 meses.
-
Modern SOTA LLM Reasoning Requires Ed’s Contribution
By
–
There's no modern sota LLM reasoning without you Ed
-
Open Source Performance Without Open Source Models
By
–
No open source model but open source perf. Sufficiently open ai I guess
