2 puntos por GN⁺ 15 시간 전 | 1 comentarios | Compartir por WhatsApp
  • Kimi Work es un agente de IA de escritorio que combina conexión con archivos locales, automatización del navegador, ejecución de código en segundo plano y tareas programadas para realizar trabajo en profundidad
  • Con su motor Cron integrado, automatiza llamadas a agentes LLM y la ejecución de Python·Shell a diario, cada hora o según condiciones, y también admite trabajos nocturnos con Keep Computer Awake
  • WebBridge navega entre varias pestañas y realiza clics, desplazamiento y extracción de datos para gestionar de forma autónoma investigación web y tareas de varios pasos
  • Agent Swarm, que coordina varios agentes especializados, procesa tareas complejas en paralelo y convierte los resultados de investigación en PowerPoint o Excel
  • Ofrece de forma predeterminada datos de acciones A, de Hong Kong y de EE. UU., y antes de modificar o sobrescribir archivos locales y ejecutar código solicita aprobación explícita mediante Ask before acting

Automatización del trabajo de escritorio

  • A diferencia de la app web de Kimi, adecuada para chats y consultas rápidas, Kimi Work es un agente local que monta carpetas locales para realizar tareas en profundidad
  • El programador Cron integrado ejecuta tareas repetitivas en segundo plano
    • Puede llamar a un agente LLM temprano por la mañana para preparar un briefing diario
    • Puede procesar grandes conjuntos de datos con un script de Python a medianoche
    • Puede iniciar llamadas a agentes LLM y ejecución de Python·Shell a diario, cada hora o de forma condicional
    • Para ejecuciones nocturnas, se puede activar Keep Computer Awake en la configuración
  • WebBridge recibe un objetivo mediante un prompt y navega por varias pestañas para realizar de forma autónoma clics, desplazamiento y extracción de datos
    • Puede revisar y resumir las noticias más recientes de un sitio web, o recopilar datos históricos de acciones y guardarlos en un Excel local
  • Agent Swarm coordina automáticamente varios agentes especializados para descomponer y resolver al mismo tiempo problemas de múltiples capas
    • Puede convertir los resultados de investigación en materiales profesionales de PowerPoint o en hojas de Excel

Datos financieros y control de archivos locales

  • Los datos de mercado de acciones A, de Hong Kong y de EE. UU. vienen integrados de forma predeterminada y pueden usarse sin configuraciones complejas de API
    • Mediante conversación en lenguaje natural, puede cargar reportes de resultados, analizar anomalías del mercado y cotejar hojas de cálculo
  • El usuario mantiene el control sobre los archivos locales
    • La protección Ask before acting solicita aprobación explícita antes de modificar o sobrescribir archivos en directorios locales, o antes de ejecutar código
    • No ejecuta esas acciones sin el consentimiento del usuario

1 comentarios

 
Opiniones en Hacker News
  • Kimi Work es un agente local que monta carpetas locales, navega la web con WebBridge y ejecuta código Python y tareas programadas en segundo plano.
    Su diseño se parece especialmente a Codex, pero el objetivo de Kimi parece estar más cerca de aparentar paridad funcional con los grandes laboratorios que de crear desde cero una UI de agente futurista.
    Su competitividad clave es un modelo barato y cercano a la frontera; solo necesita una capa de app que lo conecte. La propia copia también es una buena forma de mostrar que la capa de app puede convertirse en un producto genérico.
    • Todo el mundo ya está copiando la capa de app. Hay más de 30 clones de Claude Code; Codex también copió Cowork, y Grok y Gemini van en la misma dirección.
    • Si miras Kimi Code, cuesta creer que tenga una base de código distinta de Claude Code.
    • Kimi tiene ventaja de costos, así que le basta con hacerlo suficientemente utilizable y luego copiar. Para los laboratorios estadounidenses, podría ser el comienzo del declive.
    • En ese caso, ¿no debería existir una base open source de ejecución de agentes capaz de concentrar la demanda?
    • K3 supera a Fable en varios benchmarks. Entonces me pregunto si eso significa que Fable 5 tampoco es un modelo de frontera, o qué se considera exactamente un modelo de frontera.
  • La evaluación de que es un clon no es incorrecta, pero si puede ofrecer lo mismo a una quinta parte del precio, deja de ser un clon y se convierte en un producto que tendrá éxito.
    • Las bicicletas, autos, cámaras, puentes, represas y smartphones se parecen entre sí. La clave de la UX está en hacer algo usable y familiar para el usuario.
      Llamar simple copia a crear una GPU que funciona como una GPU es una actitud de quien no entiende la ingeniería. La parte difícil no es imaginar el concepto de alto nivel, sino implementarlo para que funcione de verdad; aunque se pueda desarmar y estudiar un producto, diseñarlo y fabricarlo por cuenta propia requiere mucha especialización.
      No es difícil mirar una computadora personal e imaginar que sería bueno que fuera más rápida, más pequeña y cupiera en el bolsillo. Cuanto menos se entiende su funcionamiento interno, más se tiende a discutir en exceso elementos superficiales como la UI o las esquinas redondeadas.
    • Dudo que Kimi realmente cueste una quinta parte del precio. En Artificial Analysis aparece al mismo precio que GPT 5.6 Sol, pero con menor rendimiento.
    • Si no puede responder ni preguntas simples sobre los uigures o la plaza de Tiananmén, aunque sea un producto exitoso, es un producto frágil.
  • Kimi parece haber copiado Codex casi 1 a 1, así que resulta especialmente descarado. Antes de Codex ya existían Conductor y varias GUI, pero esta vez parece que incluso copiaron el código.
    El aviso de privacidad también induce a error. Dice que pedirá aprobación antes de modificar o sobrescribir archivos y ejecutar código, pero no revela que el permiso de lectura de archivos se otorga sin restricciones y sin consentimiento.
    • Me parece obvio que un agente de programación tenga permiso de lectura de archivos. Es parecido a quejarse de que Dropbox tiene acceso sin restricciones a los archivos.
    • Me pregunto si todavía se acepta la creencia de que el software chino necesariamente vigila y el software estadounidense no vigila si no lo avisa.
      Lo más razonable es asumir que cualquier software, venga del país que venga, recopila tantos datos como se le permita. Si no estás ejecutando código open source compilado y auditado por ti mismo, no puedes garantizar nada.
    • Más que parecerse a Codex, parece un sitio web común de chat con IA, con un área de chat de IA al lado y acciones frecuentes ubicadas arriba.
    • La recopilación de material de internet o el movimiento de empleados entre empresas parecen ya casi una tradición de la industria en la que las compañías de IA comparten entre sí.
    • Creo que Codex es Apache 2.0: https://github.com/openai/codex
  • Es una copia bastante descarada, pero también demuestra lo fácil que es copiar. OpenAI y Anthropic tenían ventaja de pioneros, pero una ventaja obtenida fácilmente también puede desaparecer fácilmente.
    • Ahora se puede decir que ya no hay barreras de entrada.
  • Lo más sorprendente del auge de la IA es que nadie haya logrado construir una dependencia del proveedor decente. Es demasiado fácil cambiarse a otro servicio.
  • Sería bueno tener opciones como hosting en EE. UU. o una política de no retención de datos (NDR). Me gustan el precio y el rendimiento, pero me preocupan la soberanía de los datos y la filtración de propiedad intelectual a empresas extranjeras.
    • Justo después de la publicación de los pesos de K3 el 27 de julio, es muy probable que varios proveedores en EE. UU. alojen el modelo.
      Es algo aparte de Kimi Work en sí, pero parece que en menos de una semana habrá opciones estadounidenses para acceder a K3. Los proveedores que alojan K2.6 se pueden ver en OpenRouter: https://openrouter.ai/moonshotai/kimi-k2.6
    • Si se publican los pesos de K3, es muy probable que también llegue a Amazon Bedrock.
    • No pienso subir datos a una empresa china. No es solo un problema de propiedad intelectual; como ocurrió con ByteDance, aunque intenten borrar su identidad china, es muy probable que sufran restricciones de servicio en EE. UU.
  • Copiaron sin cambiar una sola palabra la frase “Let's take something off your plate” de la UI de Claude Cowork, e incluso la pusieron tal cual en la primera pantalla de la imagen principal.
  • Me pregunto cuándo se darán cuenta de que la solución no es la ejecución local, sino el self-hosting on-premise.
  • Si se repite la tendencia del pasado, la próxima semana debería salir un modelo destilado más débil que GPT 5.6 o Mythos, pero que supere por poco a Kimi K3.
  • Sería bueno integrar la UI de Code en pestañas, como Claude Code Desktop. No hay razón para separar las herramientas ni para ofrecer solo una TUI en la terminal.
    Si instalas Kimi CLI, ya puedes ejecutar una UI web local: https://www.kimi.com/help/kimi-code/cli-getting-started
    kimi server run --foreground
    Sin embargo, el botón para detener el seguimiento de subagentes no funciona, no se pueden cambiar algunos toggles en la configuración y, cuando la conversación supera los 600 turnos, se vuelve tan lento que la entrada por teclado se retrasa varios segundos.
    Personalmente, todavía me gustó más ZCode. También pienso escribir una experiencia de uso de K3; la base de ejecución de agentes necesita más pulido, pero el modelo en sí es excelente.