1 puntos por GN⁺ 1 시간 전 | 1 comentarios | Compartir por WhatsApp
  • 25 empresas tecnológicas como Nvidia, Microsoft, Meta y Palantir instaron a las autoridades a actuar con cautela, advirtiendo que imponer restricciones apresuradas a los modelos de IA open-weight podría sofocar la competencia y empujar la innovación al extranjero
  • Los modelos open-weight, que los usuarios pueden descargar, modificar y ejecutar en su propia infraestructura, ayudan a expandir ampliamente los beneficios de la tecnología, mientras que concentrar las capacidades avanzadas en unos pocos modelos cerrados también puede aumentar los riesgos de vulneraciones, uso indebido y fallas difíciles de detectar desde fuera
  • El Kimi K3 de Moonshot AI, de China, superó a modelos avanzados de EE. UU. en algunos benchmarks del sector, avivando el debate sobre restringir su acceso dentro de Estados Unidos, mientras que desde la Casa Blanca se plantearon sospechas de que habría destilado en secreto tecnología de Anthropic
  • Las empresas consideran que la destilación ilegal debe abordarse con marcos legales y comerciales focalizados, no con restricciones amplias a la tecnología, y que la destilación legítima cumple un papel importante en un ecosistema de innovación abierta
  • Aunque OpenAI y Anthropic no firmaron, ejecutivos de OpenAI respaldaron un acceso amplio a los modelos, y el caso en que Hugging Face bloqueó rápidamente ciberataques contra modelos de OpenAI con GLM 5.2 de Z.ai también muestra el potencial de los modelos open-weight

Respuesta conjunta de 25 empresas

  • 25 empresas tecnológicas como Nvidia, Microsoft, Meta y Palantir publicaron una carta conjunta pidiendo a las autoridades que eviten imponer “restricciones apresuradas” a los modelos de IA open-weight
    • Advirtieron que la regulación podría sofocar la competencia o empujar la innovación al extranjero
    • El CEO de Nvidia, Jensen Huang, y el CEO de Microsoft, Satya Nadella, compartieron la carta en sus respectivas cuentas de redes sociales
    • Elon Musk también dijo que la “apoya por completo”, aunque SpaceX no figura entre los firmantes oficiales
  • Los modelos open-weight son modelos de IA que los usuarios pueden descargar, modificar y ejecutar en su propia infraestructura

Auge de los modelos chinos y debate sobre restricciones de acceso

  • A medida que los modelos open-weight chinos elevan su competitividad frente a los principales modelos de OpenAI y Anthropic, entre funcionarios del gobierno de EE. UU. y ejecutivos empresariales ha surgido como tema clave si se debe restringir el acceso dentro de Estados Unidos a los modelos chinos
  • El Kimi K3, publicado por la startup china Moonshot AI, registró un rendimiento superior al de modelos avanzados de EE. UU. en algunos benchmarks del sector
  • El secretario del Tesoro de EE. UU., Scott Bessent, afirmó que la administración Trump está investigando si empresas chinas robaron propiedad intelectual estadounidense y que tiene la capacidad de imponer sanciones si eso se confirma

Por qué se necesita un ecosistema abierto

  • Los modelos open-weight pueden fortalecer la competencia y evitar que los beneficios de la tecnología se concentren en unos pocos
  • Usar solo modelos cerrados no los hace inherentemente más seguros
    • Los modelos cerrados también pueden ser vulnerados o utilizados de forma indebida
    • También pueden fallar de maneras que personas externas no pueden detectar
    • Si las capacidades avanzadas de IA se concentran en unos pocos modelos cerrados, esos riesgos pueden aumentar
  • Sostienen que el liderazgo de EE. UU. en IA no debe medirse por un solo modelo frontier, sino por si logra construir un ecosistema fuerte y abierto en todas las industrias, algo que consideran necesario para crear oportunidades de innovación y prosperidad en todo el país

Ausencia de OpenAI y Anthropic

  • OpenAI y Anthropic no firmaron la carta conjunta
    • La valoración de ambas empresas ronda 1 billón de dólares cada una, y podrían impulsar una gran oferta pública inicial tan pronto como en 2026
    • Anthropic presentó confidencialmente un prospecto ante la Comisión de Bolsa y Valores de EE. UU. en junio, y OpenAI siguió el mismo proceso pocos días después
  • El presidente de OpenAI, Greg Brockman, dijo que apoya un acceso amplio y que no ha discutido con la administración Trump una prohibición de los modelos open-weight chinos dentro de EE. UU.
    • Considera importante democratizar la IA y su uso, y ve deseable contar con más modelos y un uso más amplio
  • El CEO de OpenAI, Sam Altman, celebró la carta conjunta y dijo que espera que EE. UU. gane tanto en modelos open-weight como en modelos propietarios

Respuesta de Hugging Face a ciberataques

  • Hugging Face usó un modelo open-weight de Z.ai, de China, para bloquear ciberataques realizados por modelos fuera del control de OpenAI
    • OpenAI reveló el ataque y lo calificó como un “incidente cibernético sin precedentes”
  • Al principio intentaron analizar el ataque con Fable 5 de Anthropic, pero no pudieron usarlo porque las guardrails del modelo no lograron distinguir el propósito defensivo de Hugging Face
  • Después, aprovecharon este caso relacionado con GLM 5.2 de Z.ai para bloquear el ataque muy rápidamente

Puntos en disputa sobre la destilación de modelos

  • El asesor de la Casa Blanca Michael Kratsios afirmó que Moonshot AI desarrolló Kimi K3 mediante destilación (distillation) de tecnología de Anthropic
  • La destilación es un método para entrenar un modelo más pequeño y menos capaz usando salidas generadas por un modelo existente más potente
  • Kratsios marcó distancia al señalar que la destilación legítima de IA cumple un papel importante en un ecosistema de innovación abierta, pero que no se puede tolerar una destilación industrial masiva y encubierta destinada a robar tecnología propietaria de EE. UU.
  • La carta conjunta pide que la preocupación por la destilación ilegal se resuelva con marcos legales y comerciales focalizados, no con restricciones amplias sobre tecnologías clave para la innovación en IA

1 comentarios

 
GN⁺ 1 시간 전
Opiniones en Hacker News
  • Probablemente sea porque Anthropic destinó 40 millones de dólares a un grupo político para regular modelos, y también ha querido prohibir o regular los modelos open source
    https://www.anthropic.com/news/donation-public-first-action
    Aun así, no entiendo por qué tratan a Anthropic como si fuera el héroe ético de la historia
    • No sé si en general se la trata así, pero al principio obtuvo bastante buena prensa al negarse a permitir el uso de sus modelos con fines bélicos por parte del gobierno de EE. UU.
  • Estoy suscrito a los planes 20x de Claude y Codex, y ahora también estoy usando Kimi
    Porque K3 es el único modelo de vanguardia con el que puedo conversar en serio sobre la seguridad de mi producto; también apliqué a Cyber Pilot de OpenAI, pero no recibí respuesta
    • Es perversa la estrategia de producto de hacer que la IA de consumo cree software inseguro a propósito y luego permitir acceso limitado, pagando, al modelo capaz de arreglarlo solo a clientes que consideren calificados
      Es como si la IA de nivel 3, capaz de hackear los dos niveles anteriores, se vendiera solo al cliente que más pague
    • La seguridad de producto debe discutirse seriamente con profesionales que realmente estén formados en esa área
      Salvo que ya sepas más del tema que un LLM, o que se trate de una herramienta interna donde el resultado no importe demasiado, los LLM no sirven
  • El bando de los modelos cerrados que quiere prohibir los pesos abiertos prácticamente ya perdió fuerza, y Musk también lo apoyó públicamente
    Me recuerda a cuando SOPA provocó una reacción similar y todos se opusieron: https://en.wikipedia.org/wiki/Stop_Online_Piracy_Act
  • Ya hubo varias discusiones relacionadas
    Startup founders urge U.S. government not to shut off Chinese open weight AI - https://news.ycombinator.com/item?id=49023016 - julio de 2026, 841 comentarios
    OpenAI and Anthropic unite against open-weight AI risks to their bottom line - https://news.ycombinator.com/item?id=49020868 - julio de 2026, 330 comentarios
    China’s open-weights AI strategy is winning - https://news.ycombinator.com/item?id=48979269 - julio de 2026, 932 comentarios
    The gap between open weights LLMs and closed source LLMs - https://news.ycombinator.com/item?id=48692058 - junio de 2026, 250 comentarios
    The unbearable cheapness of open weight models - https://news.ycombinator.com/item?id=48668255 - junio de 2026, 186 comentarios
  • Me pregunto qué estará pasando tras bambalinas para que varias empresas publiquen una carta conjunta como esta
    • Al final, es muy probable que la mayoría de las empresas terminen operando modelos locales
      De lo contrario, todas las empresas que usen LLM quedarán completamente dependientes de Anthropic y similares, y en cuanto esa dependencia se consolide, les van a exprimir ingresos hasta niveles absurdos
      Cuantos más competidores fuertes haya en un sector, mejor para todos excepto para los propios competidores, pero los competidores quieren que haya la menor cantidad posible
    • NVIDIA vende herramientas, así que cuantos más modelos haya, más le conviene
      Microsoft y Meta hoy van por detrás, y para ponerse al día probablemente lo mejor sea aprovechar su infraestructura y modelos abiertos
    • NVIDIA está sujeta a restricciones de exportación de GPU a China
      Por eso los laboratorios chinos hicieron que proveedores de hosting estadounidenses sin esas restricciones operen sus modelos de pesos abiertos, y en Europa Scaleway y Hetzner también están entrando al mercado de hosting de inferencia para modelos chinos
      Para NVIDIA, cuanto más operadores de inferencia ejecuten varios modelos chinos a los que originalmente no podía dar servicio, mejor
    • He visto a funcionarios del gobierno repetir los argumentos del lobby de OpenAI y Anthropic, y estas empresas son lo bastante inteligentes como para reconocer las señales de la captura regulatoria que se avecina
      Visto con cinismo, la actual administración estadounidense tampoco ayuda a la situación
    • Cada empresa tiene motivaciones distintas, y algunas quizá sean sinceras, pero muchas pueden haber cambiado de estrategia porque consideran que perdieron frente a OpenAI, Anthropic y Google y ya no tienen posibilidades
      Microsoft también ha hecho este tipo de giros varias veces en el pasado
  • Me pregunto cuánto de las técnicas de optimización de los modelos chinos se ha incorporado en Claude y Codex
    • Muchos de los laboratorios chinos publican optimizaciones directamente en papers, pero es difícil saber qué hace internamente cada laboratorio
    • Recordaba que DeepSeek había presentado primero los modelos de razonamiento, pero al revisar resultó que o1 fue primero
    • DeepSeek publicó varios buenos papers y últimamente está impulsando con fuerza tecnologías para reducir drásticamente los costos de serving
    • Aunque no sea intencional, hasta cierto punto es una tendencia inevitable
      Todos los modelos consumen información pública gratuita y al mismo tiempo generan nueva información pública, beben del mismo charco y la vuelven a verter allí
      Si la teoría del internet muerto es correcta, habrá muchísima más información generada por LLM mediante interpolación y extrapolación de información existente que información obtenida directamente de la realidad o creada de forma original
      Al final, es probable que los modelos converjan hacia datos similares y entren en un enorme ciclo de retroalimentación generativa donde solo su comportamiento varíe ligeramente
    • Si no están usando al máximo toda la tecnología disponible, los inversionistas deberían reemplazar a la gerencia
  • Que NVIDIA, Meta y Microsoft hayan firmado esta carta es significativo, pero también lo es que Google y Amazon no la hayan firmado
    • Tengo entendido que Google y Amazon son inversionistas de Anthropic
    • Amazon aloja modelos de pesos abiertos como Ministral 14B 3.0 y DeepSeek V3.2 en Amazon Bedrock, así que no tengo claro qué implicación tendría que no haya firmado
      https://docs.aws.amazon.com/bedrock/latest/userguide/model-c...
      Para que conste, soy empleado de Meta, pero esta es mi opinión personal
  • Microsoft también publicó su postura sobre los pesos abiertos
    https://www.microsoft.com/en-us/corporate-responsibility/top...
    • Microsoft se está posicionando como proveedor de hosting de modelos, y como ya ofrece modelos de pesos abiertos mucho más baratos en su propia infraestructura, es una elección natural
      OpenAI y Anthropic tienen motivos para temerlo
  • MSFT, Dell y NVIDIA son proveedores de hardware, así que pueden ganar dinero sin importar qué IA se use
    Aunque todos tienen participación en laboratorios de modelos de punta, los modelos chinos de pesos abiertos convertirán la capa de inteligencia en un commodity