← Inicio

OpenAI reduce el contexto del modelo Codex de 372k a 272k tokens, frustrando a desarrolladores

El hecho

OpenAI redujo silenciosamente la ventana de contexto del modelo Codex de 372 mil a 272 mil tokens — una reducción de aproximadamente el 27%. El cambio fue detectado por desarrolladores que notaron una caída abrupta en la capacidad del modelo para procesar bases de código extensas en una sola sesión. Hasta el momento, OpenAI no ha proporcionado ninguna explicación oficial sobre el motivo de la reducción.

Codex es el motor que impulsa funciones de GitHub Copilot, incluida la capacidad de analizar repositorios enteros para ofrecer sugerencias contextuales más precisas. La ventana de contexto más grande — que permitía al modelo "leer" aproximadamente 372 mil tokens de código de una sola vez — era uno de los principales argumentos de venta del producto para equipos de desarrollo que trabajan con bases de código complejas.

Contexto

La ventana de contexto de un modelo de lenguaje determina cuánta información puede procesar de una sola vez. Para los desarrolladores que usan Codex para analizar código fuente completo, una ventana más grande significaba la capacidad de entender la arquitectura completa de un proyecto antes de sugerir cambios o generar nuevo código.

La reducción de 100 mil tokens representa una pérdida significativa — equivalente a decenas de miles de líneas de código que ahora deben dividirse en múltiples llamadas. El impacto se siente particularmente en proyectos monolíticos o en tareas de refactorización que requieren una visión holística del código.

Análisis

Reducir la ventana de contexto sin comunicación previa ni explicación erosiona la confianza de los desarrolladores. En un ecosistema donde OpenAI ya enfrenta un creciente escepticismo sobre sus prácticas de gobernanza — especialmente después de cambios unilaterales en términos de servicio y políticas de moderación — esta degradación silenciosa es particularmente mal recibida.

La reducción sugiere que OpenAI está priorizando el costo y la latencia sobre la capacidad. Mantener ventanas de contexto más grandes requiere más memoria de GPU y cómputo por solicitud, lo que presiona los márgenes operativos. Para una empresa que busca caminos hacia la rentabilidad, recortar contexto es una palanca financiera — pero para los desarrolladores, es una regresión genuina que rompe flujos de trabajo establecidos.

Qué observar

La reacción de la comunidad de desarrolladores será el principal termómetro. Las migraciones a alternativas como Claude Code (Anthropic), Gemini (Google) o modelos locales como Llama 4 y Qwen 3.8 podrían acelerarse. OpenAI podría verse obligada a revertir la decisión u ofrecer un nivel pago con una ventana de contexto más grande. El episodio también reaviva el debate sobre los riesgos de depender de APIs propietarias para herramientas esenciales de desarrollo.

Fuente: Hacker News