5 puntos por GN⁺ 1 일 전 | 1 comentarios | Compartir por WhatsApp
  • Un sitio que rastrea los anuncios en X de @thsottiaux para registrar cuándo se restablecen los límites de uso de Codex; el último restablecimiento fue hace 2 días
  • Hasta ahora contabiliza 35 restablecimientos, con un intervalo promedio de espera de 8.9 días y una brecha máxima de 67.7 días
  • Los restablecimientos no solo compensan fallas, retrasos o errores en el cálculo de límites, sino que también se usan para acompañar el crecimiento de usuarios, lanzamientos de productos, aniversarios y para incentivar el uso de nuevas funciones
  • Algunos restablecimientos recuperan al 100% los límites semanales y por hora de los planes de pago, y también ofrecen restablecimientos guardados (banked reset) que pueden aplicarse cuando el usuario quiera
  • A medida que Codex y ChatGPT Work crecieron, los restablecimientos se volvieron más frecuentes; anuncios recientes también mencionan la llegada a 7, 8 y 9 millones de usuarios activos y el proceso de ampliación de infraestructura

Registro de restablecimientos y métricas

  • Codex Resets recopila anuncios de restablecimiento de límites de uso de Codex desde el feed de X de @thsottiaux
  • Conserva los intervalos entre restablecimientos y los textos originales de los anuncios de las últimas 26 semanas
  • El estado de las métricas es el siguiente
    • Restablecimientos acumulados: 35
    • Período promedio de espera: 8.9 días
    • Mayor brecha entre restablecimientos: 67.7 días
    • El último restablecimiento fue hace 2 días

Restablecimientos por el crecimiento de Codex y ChatGPT Work

  • A medida que los usuarios activos aumentaron rápidamente, se realizaron restablecimientos consecutivos
    • Al llegar a 7 millones de usuarios activos, se agregó un restablecimiento guardado a todas las cuentas, para que pudiera aplicarse desde la app de escritorio o la web y recargar el uso semanal
    • Al llegar a 8 millones de usuarios activos, se restablecieron nuevamente todos los límites y tampoco se aplicó el límite de velocidad de 5 horas
    • El mismo día en que se alcanzaron 9 millones de usuarios activos, también hubo un restablecimiento, y se informó que seguían los trabajos para mantener la estabilidad y confiabilidad del sistema
  • Se realizaron varios restablecimientos para todos los usuarios de pago de Codex y ChatGPT Work, y en algunos casos se avisó que se reflejarían en 30 minutos a 1 hora
  • En medio de un aumento de tráfico sin precedentes, hubo un caso en el que, después de un restablecimiento, se anticipó otro adicional el mismo día

Introducción y alcance de los restablecimientos guardados

  • Un restablecimiento guardado no se aplica de forma inmediata y obligatoria, sino que queda almacenado en la cuenta para que el usuario recargue su uso semanal cuando lo desee
  • Al principio solo podía usarse en la app de escritorio, pero luego se amplió a la web y a dispositivos móviles
  • En el anuncio que agregó restablecimientos guardados para 500 mil usuarios de ChatGPT Work y Codex, se indicó que hubo un problema relacionado con menos del 10% de quienes los usaron
  • Algunos anuncios restauran de inmediato todos los límites y además otorgan un restablecimiento guardado adicional que puede usarse dentro de las siguientes 24 horas
  • Cuando un usuario ya tenía acumulados hasta 3 restablecimientos guardados, a veces se aplicó un restablecimiento forzado (hard reset) por separado de los guardados
  • También hubo casos de doble restablecimiento (double reset), que ofrecen al mismo tiempo un restablecimiento total y un restablecimiento guardado de uso libre

Compensaciones por fallas y problemas de rendimiento

  • Tras tres incidentes menores que afectaron la confiabilidad de Codex en un período de 24 horas, se restablecieron los límites de uso de todos los planes de pago y se iniciaron medidas para evitar que se repitieran
  • Después de mitigar un incidente de unos 10 minutos y confirmar la recuperación, se anunció un restablecimiento
    • Codex ayudó con el trabajo de recuperación, pero la pista final para resolverlo la encontró una persona
  • Luego de resolver otra falla y comprobar que el servicio funcionaba de forma estable durante varias horas, se restableció el límite de velocidad; en otro caso separado, cuando el servicio volvió a estabilizarse, también se aplicó el botón de restablecimiento
  • Un problema en el que solicitudes se clasificaban erróneamente como de alto riesgo cibernético y eran bloqueadas o rechazadas se corrigió en unos 8 minutos, y tras recuperar el servicio se inicializaron los límites
  • En un caso de falla menor que duró 45 minutos y se amplió a una falla global durante los últimos 30 minutos, se restableció el límite de velocidad después de la recuperación
  • Para compensar una latencia anormalmente alta en Estados Unidos o zonas cercanas, se inicializaron los límites de todos los usuarios de Codex y también se recomendó usar GPT-5.1-Codex-Max
  • Para compensar una desaceleración ocurrida mientras se preparaban GPU adicionales, se restableció el límite de gpt-5-codex, y se informó que planeaban ampliar la capacidad durante toda esa semana
  • También hubo casos en los que, mientras se resolvía la causa raíz, el restablecimiento de límites para todos los usuarios se usó como la mitigación más rápida, con aviso de que se reflejaría en unos 10 minutos

Cálculo de uso y problemas de agotamiento de límites

  • Una optimización aplicada a la compresión de sesiones largas afectó la tasa de acierto de caché, lo que hizo que los límites se agotaran antes de lo esperado; tras revertirla, se restablecieron los límites de todas las cuentas
  • En un caso en el que se investigaron reportes de que el uso de Codex se consumía antes de lo esperado, pero no se encontró una única causa central, se compensó con un restablecimiento general y un restablecimiento guardado adicional
  • Aunque no había evidencia de un impacto amplio, al recibir suficientes reportes se restableció el límite de velocidad de los suscriptores Plus y Pro y se decidió cerrar la investigación en 1 a 3 días
  • En otra investigación tampoco se confirmó un impacto a gran escala en los usuarios, pero se aplicaron medidas de mitigación, se ofreció un restablecimiento gratuito a todos los usuarios de Codex y se continuó el monitoreo
  • Al aumentar en el panel la proporción de usuarios que alcanzaban el límite, pero sin identificar completamente la causa, se restablecieron de forma preventiva los límites de todos los planes
  • Se corrigió un error por el cual el límite promocional 2x no se aplicaba a cerca del 9% de los usuarios Plus y Pro, y como compensación se inicializó el límite de velocidad de todos esos planes
  • Al reescribir el sistema base de seguimiento de uso y facturación de Codex, se restablecieron los límites y, en lugar de volver a cargar el uso pasado, se ofreció uso gratuito

Lanzamientos de planes y productos, y eventos conmemorativos

  • Se restablecieron los límites de Codex de todos los suscriptores pagos de ChatGPT, recuperando al 100% tanto el límite semanal como el límite por hora
  • Para celebrar los logros de la semana y permitir desarrollar más con GPT-5.5, se ofreció un restablecimiento a todos los planes de pago
  • En el primer aniversario de Codex, se permitió que Codex restableciera directamente los límites de velocidad de todos los planes
  • Al lanzar el nuevo plan de $100, se ofreció uso de Codex y también se realizó el restablecimiento de límites anunciado el día anterior
  • Cuando los usuarios semanales de Codex aumentaron de 2 millones a 3 millones en menos de un mes, se restableció el límite de velocidad para celebrarlo
  • Se inicializaron los límites de todos los planes para permitir probar un nuevo plugin
  • A fin de año, se restableció el límite de velocidad y se aplicó hasta el 1 de enero un límite de uso 2x respecto de lo habitual
  • También hubo varios anuncios en los que se restablecieron los límites de uso de todos los planes de pago simplemente por la llegada del fin de semana

Cómo se operan los restablecimientos

  • Los restablecimientos se usan no solo para compensar incidentes, sino también para el crecimiento de usuarios, lanzamientos de productos, pruebas de nuevas funciones, aniversarios y eventos de fin de semana
  • El alcance varía según la situación: todos los usuarios de Codex, todos los planes de pago, todos los suscriptores pagos de ChatGPT, Plus y Pro, o usuarios de Codex y ChatGPT Work
  • El momento de aplicación también cambia según el anuncio: desde aplicación inmediata hasta dentro de 10 minutos, 30 minutos, 1 hora o varias horas
  • Aunque se indicó que los restablecimientos tienen un costo, los límites se restauran repetidamente para compensar problemas de estabilidad y permitir que los usuarios desarrollen más

1 comentarios

 
GN⁺ 1 일 전
Comentarios de Hacker News
  • Se parece a los giros gratis de una tragamonedas. Un amigo está tan obsesionado con gastar por completo su cuota de Fable que vence hoy, que hasta hace un montón de tareas de utilidad dudosa solo porque parece un recurso escaso

    • Así se siente la mitad de los proyectos hechos con IA. Mis colegas administran toda su infraestructura doméstica con OpenClaw y un equipo completo de agentes, pero no entiendo para qué hace falta en una casa que ya está automatizada con Home Assistant. Fuera del trabajo, casi nunca siento la necesidad de usar IA
    • La propia IA es como una tragamonedas, y no me sorprendería que eso fuera un gran factor para provocar psicosis. Jalás la palanca con un prompt, mirás cómo gira la pantalla y muy de vez en cuando caen monedas
    • Parece que ya entraron en la fase de gamificación para impulsar el uso del producto
    • A principios de esta semana anunciaron Permafable, pero definitivamente se siente como una tragamonedas
  • Sin darme cuenta, los reinicios y la eliminación del límite de 5 horas subieron muchísimo mi línea base de uso. Ya no me estoy conteniendo y lanzo varios agentes al ritmo que quiero, al menos porque la semana pasada siguieron dando reinicios extra
    Me preocupa que el día que dejen de dar reinicios, mi flujo de trabajo habitual de repente se pase del límite y hasta cambiar al plan superior se sienta como un retroceso

    • Estos reinicios existen por la competencia con rivales. Cuando ganen el mercado, van a exprimir todo el dinero posible
    • No estoy tan seguro de que haya sido realmente “silencioso”
  • Impresiona que den estos reinicios tan seguido. Claude Code y Grok Build también reinician, pero no a este nivel, y paradójicamente Antigravity de Google, una gran empresa con abundante infraestructura, no lo ha hecho ni una sola vez que yo haya visto. Me pregunto cuánto le costarán a OpenAI estos reinicios

    • Algunos reinicios fueron para calmar a los clientes porque un bug del lanzamiento de 5.6 hizo que los usuarios de subagentes gastaran demasiados tokens
      Aun así, impresiona que tengan capacidad para absorber eso
    • OpenAI puede hacer esto seguido porque tiene suficientes recursos de cómputo, y parte de esa holgura también se debe a que está bastante por detrás de Anthropic en grandes clientes empresariales. Dicen que tras el lanzamiento de 5.6 sumaron varios millones de usuarios, así que el crecimiento es fuerte, pero queda por ver si se quedan
      Personalmente, una vez intentó algo muy peligroso cuando no estaba mirando, así que ya no lo uso para cosas importantes, y a conocidos míos también ya se les pasó el entusiasmo inicial de la luna de miel
  • Hace 5 días 7 millones, hace 4 días 8 millones, hace 3 días 9 millones: es un crecimiento impresionante

    • Como reemplazaron la app existente de ChatGPT para macOS por Codex, los usuarios “nuevos” de Codex podrían ser simplemente personas que actualizaron la app de ChatGPT
    • Esta generosidad parece posiblemente un evento para inflar la narrativa de crecimiento de la IPO. Conviene aprovechar al máximo los subsidios de IA mientras se pueda
    • Me pregunto cómo miden la cantidad de usuarios. No sé si cuentan como uno a cada persona cada vez que actualiza la app de ChatGPT
    • Como cualquier startup, seguramente cuentan a los usuarios de una forma bastante absurda. Si una persona lo usa en dos computadoras y en su celular, perfectamente podrían contarlo como 3 usuarios
      Los growth hackers y la industria del SEO han hecho que el mundo sea difícil de soportar, y la guerra psicológica de OpenClaw ya da igual porque no logró nada, pero al menos reconozco que fue una tontería ingeniosa
    • Es un growth hack inteligente: fusionaron la app de ChatGPT y la app de Codex en una sola superapp
  • Considerando incluso los reinicios acumulados, ahora mismo el valor por precio es enorme. Nuestra empresa usa Claude Enterprise a precio de API, y este mes ya consumimos 10 mil dólares, usando Opus 4.8 y agentes Sonnet 5 siempre que es posible
    En Codex Pro corro 5.6 Sol todos los días y a veces también uso modo ultra, así que si se convirtiera a uso real de API sería algo insostenible

    • Es posible que el precio de API incluya un margen enorme sobre el costo real. En mis pruebas, si en Pro 20x de 200 dólares al mes usás solo GPT 5.6 Sol, te están dando alrededor de 2,200 dólares de uso de API por semana, o sea entre 9 mil y 10 mil dólares al mes, aunque varía un poco según el costo del caché
      Los planes de 100 y 200 dólares de Anthropic tienen un límite semanal que difiere por un factor de 2, pero la diferencia en el límite de 5 horas es mayor. En cambio, el Pro 20x de OpenAI cuesta el doble que Pro 5x pero da 4 veces más uso, y todo el límite semanal de Codex de una cuenta Plus de 20 dólares es apenas el 5% del límite de Pro 20x
      Los reinicios acumulados desaparecen 30 días después de ser otorgados, así que si agotás deliberadamente toda tu cuota y luego los usás, podés maximizar el uso extra
    • Me pregunto cómo usás tanto. Nuestra empresa también usa el esquema de precios de Claude Enterprise, pero con un límite mensual de 800 dólares; incluso usando Opus para todo, recién nos acercamos al límite a fin de mes. Es difícil imaginar gastar 12 veces más tokens sin desperdiciar dinero a propósito
    • Me pregunto si Anthropic obliga a las empresas de cierto tamaño a usar el plan Enterprise, o si lo eligieron voluntariamente por las funciones empresariales. Incluso teniendo 2 o 3 instancias de VS Code corriendo Opus 4.8 Max todo el día con asientos Premium Team, no llego al límite
    • Da risa que todos tomen el precio de API como si fuera el costo real. Es muy probable que la API tenga márgenes altos, y aunque el plan de suscripción pierda un poco de dinero, si logra acostumbrar a los usuarios individuales a los modelos GPT para que luego los recomienden en el trabajo, ahí pueden ganar mucho
      Visto en promedio entre todos los suscriptores, probablemente la mayor parte del uso de la suscripción también queda sin consumirse. Algunos clientes que agotan el 100% cada semana salen muy beneficiados, pero la mayoría usa mucho menos
      El juego de los reinicios, que te mete presión para usar lo máximo posible antes del próximo reinicio impredecible, es un mecanismo para volver más adictos al producto a los usuarios más intensivos
    • Me da pena no haber podido usar ni uno de 4 reinicios vencidos, pero total ya me reiniciaron otra vez todo el uso. Estoy avanzando a lo loco con proyectos que normalmente no habría hecho usando 5.6-Sol-ultra; se trata de editar de forma masiva la novela de otra persona y agregar ilustraciones
  • Me costó enterarme de que cuando empieza el ciclo semanal, Codex elimina los reinicios que tengas guardados

  • Me gusta: es como si dos padres compitieran por ver quién le da más regalos a su hijo. Es como tener Navidad dos veces

    • Anthropic no da muchos regalos
  • Anthropic reinicia de forma constante entre jueves y viernes, así que es algo desfavorable para los usuarios a quienes originalmente les toca reinicio en ese momento

    • Si Anthropic también diera reinicios gratis, ahora mismo lo mejor en relación costo-beneficio sería usar dos suscripciones de 20 dólares al mes juntas
  • Ojalá hubiera un endpoint oficial de API para consultar por programación el uso de Codex y la hora de reinicio de la cuota. Así se podría crear con vibe coding una app que avise cuando el uso vuelva al 100% porque OpenAI ya lo reinició, o cuando queden 10% de las 5 horas de uso
    Por ahora hay que usar Codex App Server de forma indirecta, así que no es lo ideal

    • La hora de reinicio de la cuota se puede consultar en este endpoint. Si envías una solicitud GET usando el token local de autenticación de Codex como token Bearer, la respuesta incluye available_count y credits[].expires_at
      https://chatgpt.com/backend-api/wham/rate-limit-reset-credit...
    • Basta con usar CodexBar
      https://github.com/steipete/CodexBar
    • Actualmente el límite de 5 horas ya desapareció, así que no hace falta rastrearlo. Lo demás se puede resolver pidiéndole una vez a Codex que genere código en Python para devolver el uso restante y la próxima fecha y hora de reinicio
      El resultado usa Codex App Server, pero como es un proceso temporal que se comunica por stdio, está bastante bien
    • Tengo esta página en marcadores y la reviso seguido
      https://chatgpt.com/codex/cloud/settings/analytics
    • La primera parte parece poder revisarse en ese sitio. Quizá también ofrezcan una API de notificaciones
  • Es un sitio útil. Me gusta el reinicio y todavía tengo 3 reinicios sin usar, así que sigo usando modo 5.6 Sol Fast con 1,000 millones de tokens al día
    Eso sí, al quitar el límite de 5 horas, confirmé en Codex que redujeron silenciosamente el contexto de 5.6 Sol de 354k a alrededor de 258k

    • Hay algunos tuits relacionados, así que no fue un cambio completamente silencioso. Si configuras model_context_window=YOUR_VALUE en ~/.codex/config.toml, parece que se puede volver al tamaño original