NVIDIA anunció una alianza con OpenAI para poner a disposición del público la nueva familia de modelos abiertos gpt-oss, llevando a los consumidores una inteligencia artificial de última generación que antes estaba limitada a centros de datos en la nube. Gracias a la potencia de las GPUs GeForce RTX y RTX PRO, ahora es posible ejecutar estos modelos con una velocidad sin precedentes directamente en PCs y estaciones de trabajo.
La compañía presentó dos variantes: gpt-oss-20b, optimizado para PCs con al menos 16 GB de VRAM y capaz de alcanzar hasta 250 tokens por segundo en una GPU RTX 5090, y gpt-oss-120b, pensado para estaciones de trabajo profesionales con GPUs NVIDIA RTX PRO. Ambos modelos fueron entrenados en GPUs NVIDIA H100 y son los primeros en admitir precisión MXFP4 en RTX, una técnica que mejora la calidad y precisión del modelo sin afectar el rendimiento. Además, ofrecen hasta 131,072 tokens de contexto, uno de los más amplios disponibles para inferencia local.
Construidos sobre una arquitectura mixture-of-experts (MoE), los modelos incluyen capacidades de razonamiento encadenado (chain-of-thought), seguimiento de instrucciones y uso de herramientas. NVIDIA también destacó opciones para que desarrolladores y entusiastas comiencen a utilizarlos, como la aplicación Ollama —que ofrece soporte nativo y optimizado para GPUs RTX—, las optimizaciones de la comunidad en Llama.cpp, y el acceso desde Microsoft AI Foundry Local en Windows.
El CEO de NVIDIA, Jensen Huang, subrayó la relevancia del lanzamiento: “OpenAI le mostró al mundo lo que se podía construir sobre la IA de NVIDIA y ahora están impulsando la innovación en el software de código abierto. Los modelos gpt-oss permiten a los desarrolladores de todo el mundo construir sobre esa base, fortaleciendo el liderazgo tecnológico de EE. UU. en IA sobre la infraestructura de cómputo de IA más grande del mundo”.






