1 puntos por GN⁺ 2 시간 전 | 1 comentarios | Compartir por WhatsApp
  • Durante cerca de 2 años había usado Claude y ChatGPT, pero al conectar opencode a un endpoint de inferencia propio sintió una liberación mayor de la esperada
  • Como los datos solo iban y venían entre su laptop y un endpoint que le pertenece, aumentó la sensación de control y propiedad
  • En vez de subir de plan en Claude o ChatGPT para uso personal, decidió usar Kimi K3, lanzado por Modal como endpoint administrado, para proyectos paralelos
  • En unos 5 minutos configuró y ejecutó opencode para que usara su endpoint de Modal
  • Se sintió tan simple como abrir vim en lugar de un editor grande y llamativo, y le dio una sensación de libertad, como si se hubiera soltado de una conexión atada a otro proveedor

Qué lo llevó a elegir su propio endpoint

  • No había un plan de Claude o ChatGPT adecuado para una cuenta personal, así que en vez de subir de plan para proyectos paralelos buscó otra alternativa
  • Modal, donde trabaja, lanzó Kimi K3 en endpoints administrados, y como se decía que su rendimiento era sólido, decidió probarlo personalmente
    • No participó directamente en el desarrollo de esa función, así que antes no había podido usarla

Cómo cambió la experiencia de uso al conectarlo con opencode

  • En unos 5 minutos conectó opencode a su endpoint de Modal y lo puso a funcionar
  • La estructura en la que los datos van y vienen entre su laptop y un endpoint que le pertenece aumentó la sensación de control y propiedad
  • La pantalla inicial vacía y simple de opencode se parecía a la experiencia de abrir vim después de usar durante mucho tiempo un editor grande
  • La sensación de libertad, como si se hubiera cortado una conexión que lo mantenía atado a otro proveedor, fue un cambio que no esperaba

1 comentarios

 
GN⁺ 2 시간 전
Opiniones de Hacker News
  • Claude Code es popular porque, con pedidos vagos como “hazme un SaaS de un millón de dólares”, puede generar de una sola vez miles de líneas de código, además de muchas funciones y manejo de excepciones superficiales.
    Los modelos pequeños y abiertos son flojos para ese tipo de trabajo, pero el desarrollo real no consiste en pedir una app completa de una vez y listo. Si se iteran y mejoran funciones pequeñas y concretas como en el desarrollo tradicional, GLM lo hace tan bien como Claude, o incluso mejor; y si se le da el contexto con claridad, como en una depuración tipo rubber duck, casi siempre entrega resultados muy limpios.

    • Personalmente, DeepSeek v4 Flash me resultó tan útil como Opus. Si, en vez de buscar una demo técnica de una sola vez, tienes el entendimiento técnico para pedir cambios concretos con la terminología correcta, es suficiente; después de cargar saldo en OpenRouter, pasó bastante tiempo antes de que mi gasto llegara a 1 dólar.
    • Los modelos de frontera como Opus 5 también son excelentes para combinar elementos de varias disciplinas académicas y, a partir de pedidos vagos y especulativos, a veces producir incluso resultados de investigación novedosos con calidad publicable.
      También permiten implementar métodos ya conocidos en alrededor de una centésima parte del tiempo que tomaría hacerlo a mano, para explorar ideas rápidamente; e incluso escriben desde cero implementaciones con casi ninguna dependencia de terceros fuera de NumPy o SciPy, mejorando la claridad y el rendimiento.
    • Estas herramientas reducen mucho la barrera de entrada para quienes no son ingenieros de software. Como científico de datos en el área ambiental, tengo experiencia limitada en frontend, pero durante unas semanas completé con Claude una app de Android para ayudar a mi pareja con el manejo de su caballo, y ahora está en pruebas.
      En la etapa de planificación especifiqué durante varios días los servicios y funciones que usaría, pero también hubo funciones omitidas que no mencioné explícitamente en los pedidos, como implementar X y olvidarme de las funciones de editar y eliminar. Ya había hecho una prueba de concepto de la funcionalidad central, pero no tenía una interfaz fácil de usar; gracias a Claude pude crear rápidamente una app a medida aun con poco tiempo disponible. Si lo hubiera hecho solo, habría tardado más de un año incluso para obtener un resultado menos pulido.
    • Ante el pedido absurdo de “hazme un programa para reemplazar Microsoft Word”, ChatGPT explicó décadas de manejo de casos especiales, correcciones de bugs, funciones raras y flujos de trabajo, y preguntó si eso era realmente lo que se quería. En cambio, Claude empezó de inmediato a trabajar para construirlo, lo cual fue sorprendente.
    • Cuando los modelos abiertos también puedan crear apps completas de una sola vez, creo que todos olvidarán rápidamente la “forma de desarrollar software” tradicional.
  • El rendimiento de DeepSeek V4 Flash es bastante mejor de lo esperado. Uso principalmente Claude Code basado en Claude 5 Opus y Codex basado en GPT-5.6 Sol, pero DS V4 Flash no se siente muy inferior, y con oh-my-pi o el pi básico funciona bastante bien.
    Los modelos de frontera son mucho más fuertes en llamadas a herramientas, lo que favorece los flujos de asistente, pero al optimizar el entorno de ejecución reescribiendo las herramientas para ajustarlas a la forma en que el modelo infiere, DS V4 Flash también funciona suficientemente bien. Los modelos pequeños tienen una latencia hasta el primer token y tokens por segundo mucho mejores, así que son competitivos en varias tareas, y se sienten parecidos a Sonnet de fines del año pasado, lo cual es bastante notable.

    • El fin de semana armé por mi cuenta un sistema tipo OpenClaw y estoy usando DeepSeek v4 Flash y Qwen como asistentes basados en Matrix, con un costo de unos 2 dólares al mes. Es más útil que ChatGPT porque puedo controlar por completo las herramientas a las que tiene acceso.
      Puede fotografiar historias clínicas y agregarlas al calendario, etiquetar y procesar con OCR PDFs para archivarlos, y también hacer búsquedas en internet y consultar datos de Google Maps. Al integrarlo con Home Assistant y un sistema open source similar a Alexa, también puedo hablar por voz con el agente.
  • En la práctica es publicidad encubierta, pero justo era una configuración que me daba curiosidad, así que el contenido en sí está bien. Aun así, hacen falta métricas de costo para poder decidir cuánto extra habría que pagar para no enviar las conversaciones directamente a la NSA.
    Se sabe que Claude y OpenAI están bastante subsidiados, así que me da curiosidad si usar Kimi K3 en un endpoint privado sería más caro o más barato.

    • Si te preguntas cuántos agentes de programación “gratis” puedes usar según el costo, están los resultados de la investigación de Fable: https://claude.ai/public/artifacts/2c9a5001-0b7e-4944-beb1-9...
    • En OpenRouter, cada página de modelo muestra los precios por proveedor y un ícono que indica si no conserva datos. También se pueden configurar reglas de protección para toda la cuenta y bloquear el enrutamiento hacia proveedores que no sean ZDR.
  • Este artículo es publicidad de su propio producto. Aunque el autor tenga mucha trayectoria y lo haya escrito con honestidad, un texto que dice “probé mi producto y fue muy bueno” no deja de ser autopromoción.

    • El artículo ya fue marcado, así que no hará mucha diferencia, pero no hubo ninguna intención publicitaria. No fue algo que alguien pidiera ni un texto planeado de antemano; simplemente tenía tiempo para crear algo en casa, necesitaba un LLM que me ayudara a desarrollar y un LLM para usar dentro del producto, y probé el endpoint de Modal que tenía en mente.
      No quería subir mi plan de Claude, y si no me hubiera parecido interesante no habría escrito nada. Lo central que me llevó a escribir no fue “Modal es genial”, sino la sensación descrita en el texto. Incluso consideré eliminar el enlace por miedo a que pareciera publicidad; que la empresa donde trabajo haya hecho algo genial fue solo una ventaja secundaria.
    • En HN aparecen constantemente posts de blog que promocionan Anthropic; cuesta aceptar el criterio de que esos no sean publicidad y este artículo sí.
    • Si el producto es realmente bueno, no hay motivo para que el desarrollador lo promocione directamente.
    • Para mantener el artículo, sería más apropiado agregar Show HN al inicio del título.
    • Muchos artículos en HN son autopromoción, y si son interesantes o no se filtra en el proceso de llegar a la portada. La autopromoción interesante sigue siendo interesante.
  • GLM 5.2 se siente mejor que Opus, y K3 es tan bueno como Fable. Espero que destilen K3 a una escala como Qwen 3.6 27b o Poolside S 2.1 y aparezca un reemplazo local rápido para Composer 2.5.

  • Al pasar de grandes modelos de frontera a modelos ágiles como Composer, a veces se siente parecido a abrir vim en lugar de un editor vistoso y pesado.
    Con un modelo rápido, el ciclo entre pensamiento y preguntas y respuestas fluye mejor, parecido a moverse rápidamente entre archivos con vim.

  • Me gusta la interfaz casi vacía de OpenCode. Es limpia, liviana y pasiva, así que da una sensación de velocidad distinta a la de las herramientas modernas de internet, que son atractivas pero lentas.

    • Pi Agent se siente mucho más liviano, vale la pena probarlo.
  • Este artículo parece un anuncio de Modal. Si están alquilando hardware, también me pregunto si realmente se puede llamar infraestructura propia.

  • Independientemente de si es chino o no, hay que preocuparse por usar un modelo alojado y no saber a dónde se envían los secretos comerciales.
    También probé modelos locales, pero en una MPB M5 básica de 16 GB son lentos, y por ahora no tengo planes de actualizar la laptop.