1 puntos por GN⁺ 1 시간 전 | 1 comentarios | Compartir por WhatsApp
  • A partir del 31 de julio de 2026, la página Usage de los planes de autoservicio, como Individual y Teams, pasará a mostrar solo tokens, y desaparecerán la métrica Spend, la columna Cost y los costos en dólares del CSV
  • El motivo es que el costo convertido del uso incluido se mostraba mucho más alto que el precio real del plan, lo que generaba confusión; en el plan Enterprise, cuya estructura de consolidación de uso es distinta, se mantendrá la visualización en dólares
  • El cambio se aplica al momento de la consulta, por lo que incluso las solicitudes pasadas devuelven chargedCents: 0 y usageBasedCosts: "$0.00"; ni siquiera en solicitudes on-demand realmente cobradas se puede ver el costo por solicitud
  • Los administradores de Teams pueden consultar algunos datos de gasto en el Dashboard y la Admin API, pero en los planes de autoservicio ya no se ofrece el desglose en dólares por modelo que existía antes
  • Los usuarios señalan que, como cada modelo tiene precios por token distintos, es difícil comparar costos, eficiencia y presupuestos, y piden un gráfico en dólares que distinga entre uso incluido y cargos reales, o una opción para alternar la visualización

Visualización de costos eliminada en los planes de autoservicio

  • Con el cambio desplegado el 31 de julio de 2026, la página Usage de los planes de autoservicio, incluidos Individual y Teams, pasó a mostrar solo tokens
    • Se eliminaron la métrica Spend y la columna Cost
    • En el CSV de Usage tampoco se muestran costos en dólares, y los valores Cost restantes se establecen en 0.0 para todos los registros
    • No es posible alternar en la configuración entre visualización en tokens y en dólares, ni volver a la pantalla anterior
  • Los planes Enterprise, que tienen una estructura de consolidación de uso, pueden seguir viendo montos en dólares en la pantalla Usage

Motivo del cambio a una base por tokens

  • En el plan Individual, el uso incluido es amplio, por lo que había casos en que el monto convertido a precios de API para las solicitudes se veía más alto que el costo real del plan
  • Para reducir esa confusión, el criterio de reporte de uso en los planes de autoservicio se cambió de dólares a tokens
  • El uso incluido de Ultra se muestra como cantidad de tokens y Included, y dentro de ese rango no se cobra ningún costo adicional
  • Al principio se informó que el uso on-demand que superara lo incluido permanecería en dólares en la columna Cost y en el CSV, pero luego se corrigió indicando que ni la pantalla Usage ni el CSV de los planes de autoservicio proporcionan costos en dólares

Vías actuales para consultar costos

  • En Dashboard > Spending se muestra el total de On-Demand Spending del ciclo de facturación actual, correspondiente al monto realmente cobrado
  • Los administradores de Teams pueden ver el total on-demand por usuario en Dashboard > Members > On-Demand
  • En los planes Teams de autoservicio e Individual ya no se puede ver el desglose en dólares por modelo que ofrecía la pantalla Usage anterior
  • Los administradores de Teams pueden recibir datos de gasto y campos de costo de eventos de uso mediante la Admin API compatible
    • Usuarios del foro piden un endpoint que permita obtener directamente el costo de un usuario y período específicos, además de una pantalla de administración más simple

Endpoint de Usage y datos históricos

  • https://cursor.com/api/dashboard/get-filtered-usage-events devolvía los siguientes campos de costo por solicitud hasta antes del cambio
    • chargedCents
    • usageBasedCosts
    • tokenUsage.totalCents
  • Desde el 31 de julio de 2026, chargedCents pasa a ser 0, usageBasedCosts pasa a ser "$0.00" y totalCents se omite
  • Como la eliminación de costos se aplica al momento de leer los datos, también se aplicó retroactivamente a los eventos de uso pasados, y los costos desaparecen del endpoint Usage incluso para solicitudes on-demand realmente cobradas
  • Se confirmó que esto no es un error temporal de reporte, sino un cambio intencional
  • El monto total cobrado por período sigue disponible, pero los reportes independientes de costo por solicitud construidos sobre los campos anteriores ya no funcionan de la misma manera

Cómo se usaba la información de costos

  • Varios usuarios mantenían abierta la pestaña Usage o la revisaban varias veces al día para hacer seguimiento de sus presupuestos diarios, semanales y mensuales
  • Los usuarios de Teams consultaban el gasto por miembro dentro del límite on-demand compartido y analizaban costos por usuario, modelo y solicitud
    • Un usuario de Teams señaló que el costo de uso acumulado del ciclo de facturación actual es de 30 mil dólares, basado en su mayor parte en precios de API
  • Algunos actualizaban la página Usage antes y después de una solicitud para comparar costo y rendimiento por modelo
    • Aumento de aproximadamente $0.32 después de una solicitud con Cursor Grok 4.5
    • Aumento de aproximadamente $2.56 después de usar Opus 5
  • Algunos usuarios usaban el monto mostrado no como cargo real, sino como una cifra para estimar el valor de uso y el ahorro de costos obtenido con la suscripción
  • Como cada modelo tiene precios por token distintos, con solo la cantidad de tokens es difícil comparar directamente el costo y la relación precio-rendimiento

Alternativas que piden los usuarios

  • Se pide ofrecer un toggle o menú desplegable para poder elegir el gráfico en dólares anterior, aunque el valor predeterminado se mantenga en Tokens
  • Si el gráfico separa el valor convertido del uso incluido y el monto on-demand realmente cobrado, se podría reducir la confusión y a la vez mantener la información en dólares
  • Los totales por usuario no reemplazan el análisis diario, por modelo y por solicitud, por lo que continúan los pedidos para restaurar la columna de costos y los campos de API por solicitud
  • Si hay un plan de migrar a largo plazo a una tarificación basada en tokens, debería comunicarse públicamente; muchos reaccionan diciendo que este cambio dificultó la estimación del gasto mensual y el control de costos

Problema separado relacionado con la selección de subagentes

  • También se planteó un problema en el que, a diferencia de la configuración predeterminada de subagentes, se selecciona automáticamente otro modelo
  • explore es un tipo de subagente, y Agent puede ejecutar otros tipos de subagentes que usan modelos distintos
  • Se puede ver más información sobre este comportamiento en Sub agents triggers even when disabled and uses Opus for no reason

1 comentarios

 
GN⁺ 1 시간 전
Comentarios en Hacker News
  • Recomienda medir periódicamente el uso de tokens por combinación de harness y modelo en tareas específicas.
    Incluso al ejecutar la misma tarea con el mismo modelo y entorno, la eficiencia y el desperdicio de tokens varían mucho entre agentes.
    Los resultados de repetir 10 tareas de agente en varios harnesses con GPT 5.6 Sol en una VM de Ubuntu 26.04 fueron los siguientes:

    Harness API total Input Cached Uncached Output
    smol 172,807 142,334 8,704 133,630 30,473
    Pi 427,211 392,767 137,216 255,551 34,444
    OpenCode 1,564,429 1,523,957 1,204,736 319,221 40,472
    Codex 3,005,744 2,953,154 2,649,344 303,810 52,590
    Hermes 3,856,611 3,808,231 3,167,232 640,999 48,380
    Claude Code 5,073,137 5,029,969 4,587,008 442,961 43,168

    https://x.com/__tosh/status/2083593799872237680
    Ya esperaba que Claude Code no estuviera optimizado para modelos de OpenAI, pero fue impactante ver una diferencia así solo por el harness.
    smol, que está desarrollando personalmente, es un harness simple que usa un prompt de sistema mínimo, una sola herramienta de shell y ningún archivo de funciones.
    No hay que subestimar cuánto contenido meten los harnesses populares en la ventana de contexto.

    • Me pregunto si hay datos para juzgar si realmente es contenido inútil, o si se trata de contexto útil especializado para el proyecto o el lenguaje de programación.
    • Me da curiosidad qué tan complejas son las tareas que hace con smol. Quisiera saber si el agente resuelve todo con sed, si creó sus propias herramientas y por qué no usa Pi.
      La diferencia de tokens entre ambos harnesses también es interesante. El prompt del sistema no parece tan distinto, e incluso Pi probablemente sea más corto, y cuesta pensar que solo cuatro herramientas expliquen esa diferencia, así que quisiera probarlo personalmente.
    • Claude Code inyecta una gran cantidad de herramientas en el prompt del sistema, y solo el sistema de memoria ocupa más de 10 mil tokens.
      En tareas con poco uso de contexto pero muchos ciclos, como un loop de monitoreo, el costo puede duplicarse fácilmente.
      Hay que quitar las herramientas innecesarias con --disallowed-tools, pero como siguen agregando nuevas, se vuelve un juego interminable de golpear topos.
    • La ventana de contexto no es simplemente importante; lo es todo. Para usar Claude Code de forma eficiente, uno mismo tiene que decidir cuándo comprimir.
      Por defecto usa un contexto de 1 millón de tokens y no se limita por sí solo. En cambio, que smol lea tan poco del caché podría ser un problema de configuración.
    • Me pregunto qué herramientas usó para la comparación, o si ejecutó los prompts y luego lo revisó con una herramienta como ccusage.
      Estoy buscando una herramienta para comparar harnesses de agentes y quisiera ver no solo input y output, sino también el prompt del sistema, el rastro de ejecución y las llamadas a herramientas.
      Tener menos tokens no es un buen resultado si se omitieron verificaciones importantes, y usar más tampoco significa que sea mejor; quizá simplemente pensó demasiado. Ver el rastro completo de ejecución de la misma tarea ayuda a entender por qué Codex usa mucho y Pi usa poco.
  • He usado y pagado Cursor con entusiasmo desde 2023, pero en los últimos 6 meses casi no lo he abierto.
    Hoy en día escribo código con Claude Code y Codex, leo y reviso en GitHub, y cuando veo algo en local uso un editor de texto normal.
    Me pregunto cuál es el valor de Cursor en 2026.

    • He usado Windsurf y Cursor, y hasta di feedback de producto al equipo de Cursor, pero por el costo dejó de valer la pena. Parece que la ventaja de Cursor es sacarles dinero a los usuarios aún más rápido que Claude.
    • Cursor tiene dos ventajas. Sigue siendo un IDE, así que puedes trabajar sin la molestia de tener VSCode/Cursor abierto aparte de Codex, y es más cómodo revisar cambios a fondo dentro del IDE que en la vista de diffs de GitHub.
      Además, como soporta todos los modelos, es fácil probar otro cuando no te convence el primer resultado.
    • Cursor Tab es útil al editar directamente, pero no está claro que valga 20 dólares al mes. Si costara 5 dólares al mes, sería de esas suscripciones que mantienes solo por Cursor Tab y luego olvidas.
      En el rango de 20 dólares la competencia es demasiado fuerte, así que prefiero plugins de Claude o Codex antes que la barra lateral de coding agent de Cursor.
    • Con los cambios recientes, parece que Cursor empeoró para editar código directamente. No sé hacia qué apunta y ya no se siente como un fork de VSCode, así que estoy considerando alternativas.
      Aun así, el flujo de trabajo de ir y venir entre Claude Code y Codex y revisar en GitHub sí parece engorroso; del lado de Cursor se siente más integrado y con menos fricción.
    • También vale la pena echarle un vistazo a Cursor CLI: https://cursor.com/cli
  • Como empleado de Cursor, puedo confirmar que en la página de Spending todavía se puede ver el importe real facturado.
    Mientras limpiábamos un feature flag antiguo, ayer rompimos por accidente la visualización del costo en dólares en la exportación CSV de Usage, pero ya quedó corregido.
    Ese flag también mostraba a algunos usuarios self-service un gráfico de uso en dólares, pero como incluía en dólares hasta el uso de planes que en realidad no se cobran, generaba confusión. Como algunos usuarios lo interpretaban como gasto real, quitaron el gráfico.

    • También quitaron el indicador circular de costo que estaba junto a la visualización del uso de contexto. Ahora es más fácil no darse cuenta de que dejaste activado un modelo caro hasta agotar por completo los créditos incluidos, y cuesta creer que ese no fuera el objetivo del cambio.
    • Esta es la pantalla donde no aparece en la página de Spending: https://www.pasteboard.co/dNXUdT-h8Giy.png
      Si la respuesta es que solo los administradores pueden verlo, entonces no sirve de mucho. No se le puede preguntar todos los días al administrador por el avance ni pedirle en cada sesión que revise la eficiencia de costo del modelo.
    • Me pregunto si de verdad creen que los usuarios suscritos, al ver una cifra en dólares, no pueden entender siquiera que se trata de la tarifa de API que aplicaría sin suscripción; es un cambio muy malo.
  • Cursor se difundió rápido porque facilitaba migrar desde Visual Studio Code, pero eso es un arma de doble filo. También es fácil volver a VS Code y a las extensiones de agentes

    • Me cambié de VS Code a Cursor en 2023, pero cuando Opus 4.7 o 4.6 mejoró mucho en diciembre de 2025, volví a Claude Code y VS Code
      Como vengo de Sublime Text, ya tenía muy interiorizados los atajos predeterminados de VS Code, y terminé harto de que Cursor interceptara casi todas las combinaciones de CMD
      Ahora solo necesito un visor de código rápido, así que quizá vuelva a Sublime Text
    • Cursor tiene un asistente para importar configuraciones de VS Code, pero no existe una herramienta de migración en sentido contrario. Al menos hace unos meses, ni siquiera había una herramienta de migración entre computadoras
  • En adelante, Elon les pagará a los empleados con tokens, y hasta el supermercado mostrará precios dinámicos basados en tokens, así que el precio al tomar un producto y el precio al pagar serán distintos. Total, como Elon dijo que pronto el dinero va a desaparecer, no pasa nada

    • Mi esposa nunca ha usado IA y hasta lee libros en papel
      Yo no puedo leer un libro ni quedarme quieto en la playa; siempre tengo que nadar hacia algún lugar con propósito, así que mientras hago vibe coding de la próxima web app canadiense hasta tengo que preguntarle a Copilot qué cenar
      Amo a mi esposa y claramente aporta valor agregado, pero no me gusta la idea de que quiera compartir mis tokens
  • Lo vi ayer mismo en el trabajo: un cambio que oculta el costo del servicio es abiertamente hostil hacia el usuario
    No hay otra forma de disfrazar un cambio que perjudica al usuario y beneficia a la empresa. Parece que tienen que justificar haber adquirido por 60 mil millones de dólares un IDE y un modelo que en ese momento estaba decente

  • Cuando los usuarios empiezan a calcular el ROI de los productos de IA, el problema se resuelve ocultando la I de la inversión

    • Parece que estas empresas quieren volver opaco el uso de tokens, parecido a muchas facturas de AWS en organizaciones grandes
      Con disciplina estricta y etiquetas adecuadas, se puede rastrear adónde va el dinero, pero en la práctica casi nadie lo hace
      Da la impresión de que quieren volver muy difícil distinguir entre ingenieros que desperdician IA e ingenieros que generan alto valor por token
  • Cursor fue un excelente punto de partida para entrar al mundo de la ingeniería basada en agentes, pero la competitividad de precio de Claude parece venir sobre todo de las compras a gran escala
    La verdadera ventaja defensiva es Composer 2.5, y considero que la experiencia de uso del agente y del IDE queda por debajo de Codex y Claude Desktop
    En términos económicos, Cursor puede ser la opción más razonable, pero cuando la diferencia de precio no es grande, la capacidad importa más que el costo
    Últimamente uso Codex y Claude Desktop, y cuando necesito revisar código uso Zen. La función de conversación de voz en tiempo real de Codex, que no es simple dictado, es única cuando se combina con un flujo de trabajo con agentes

    • Ahora que es propiedad de SpaceX, Grok 4.5 también podría verse como parte de la misma familia. Grok 4.5 se siente como Sonnet, y Composer como un modelo rápido y competente equivalente a Haiku
  • Cursor era el proveedor corporativo para acceder a modelos no Anthropic, pero al desaparecer la información de costos y dejar de ser posible usarlo como proxy para solicitudes API, su valor cayó muchísimo
    Presionaron fuerte para renovar bajo ciertas condiciones del plan existente y luego rompieron esa promesa de inmediato, así que pienso dejarle claro a la gerencia que debe minimizar el uso de Cursor y no renovarlo
    Sobre todo si no eres un cliente empresarial grande, no se le puede confiar propiedad intelectual a Cursor, y a otros usuarios también les conviene no confiar en él

  • Es el proceso típico de cuando una empresa se vuelve codiciosa. Guardé ese hilo y me pregunto si Cursor lo cerrará o lo borrará