5 puntos por GN⁺ 1 일 전 | 4 comentarios | Compartir por WhatsApp
  • Alibaba Qwen lanzó Qwen3.8 con una escala de 2.4 billones de parámetros y planea publicar pronto sus pesos abiertos
  • Qwen afirmó que Qwen3.8 es un modelo en continua evolución y compatible con los principales modelos frontier de IA
  • El equipo de Qwen evalúa a Qwen3.8 como uno de los modelos más potentes actualmente y un nivel por encima de Fable 5
  • Qwen3.8-Max-Preview puede probarse de inmediato en Alibaba Token Plan, Qoder y QoderWork
  • Token Plan opera páginas de precios separadas para usuarios internacionales y usuarios de China
    • Para usuarios internacionales, se ofrece en 3 niveles: Lite/Standard/Pro, con precios promocionales mensuales de $6/$18/$68 respectivamente
    • Según el plan, se incluyen 2,500/10,000/40,000 Credits cada 7 días y 700/3,000/12,000 Credits cada 5 horas
    • Los agentes que pueden ejecutarse simultáneamente son 1~2/3~4/6~8 respectivamente, y es posible conectarlo mediante API Key y Base URL desde herramientas compatibles con los protocolos de OpenAI/Anthropic

4 comentarios

 
fanotify 1 일 전

Vi una infografía y la comparto: https://i.postimg.cc/63yLvz16/modelsize202607.png
(actualizado agregando ligeramente el contenido de Qwen 3.8 de esta vez al de Kimi)

 
cadenzah 1 시간 전

¡No abran ese enlace en un lugar público!

 
thkweon 1 일 전

Hay muchísima publicidad en el sitio.

 
GN⁺ 1 일 전
Opiniones de Hacker News
  • Este anuncio parece venir después de que Moonshot AI anunciara que publicará en Hugging Face el LLM Kimi K3 de 2.8 billones de parámetros con pesos abiertos antes del 27 de julio
    Alibaba también respondió diciendo que pronto publicará Qwen 3.8 de 2.4 billones de parámetros con pesos abiertos; queda la duda de si ya era el plan original o si lo decidieron para competir con Moonshot AI
    En cualquier caso, el ganador de esta competencia de LLM es el usuario

    • Es difícil asegurar cuál es la motivación, pero las empresas chinas parecen estar esforzándose por convertir la inteligencia en un bien de uso general
      Puede ser la forma más efectiva de reducir el valor de los laboratorios de vanguardia de EE. UU., y también es muy beneficioso para la humanidad
    • En las redes sociales chinas aparece seguido una broma: “los gobiernos de otros países intervienen para impedir conductas anticompetitivas, pero el gobierno chino interviene para frenar la competencia”
      https://www.reuters.com/business/autos-transportation/what-i...
    • La razón de anunciarlo ahora es que se está celebrando la World AI Conference
      Mientras robots boxean y las principales empresas chinas de IA presentan sus modelos más recientes, Xi Jinping también anunció la creación de WAICO
      https://en.wikipedia.org/wiki/World_Artificial_Intelligence_...
    • También podría ser un anuncio sincronizado con el momento en que Xi Jinping lanzó una alianza política en la World AI Conference y dijo que “el desarrollo de la IA no debe ser un solo país corriendo solo, sino una sinfonía de cooperación internacional”
      En las grandes conferencias normalmente se acumulan lanzamientos y anuncios de productos nuevos
      https://www.cnbc.com/2026/07/17/x-china-ai-summit-risks-secu...
    • Ojalá hubieran publicado Qwen 3.7-27B·122B o las versiones equivalentes de 3.8 en lugar de un modelo gigante
      La fortaleza de Qwen y QwQ siempre ha sido la mejor inferencia local que se puede correr en casa
  • Alibaba Cloud bloqueó mi dirección de correo y no puedo pagar el servicio, así que esta vez no pude hacer la prueba del pelícano
    Estoy esperando a que publiquen los pesos abiertos o a que aparezca en OpenRouter

    • El benchmark Pelican es ahora casi el único procedimiento de evaluación en el que confío
      También es absurdo que una empresa como Alibaba haga tan difícil recibir pagos, cuando uno pensaría que querrían que desarrolladores conocidos probaran sus modelos
      Normalmente llega rápido a OpenRouter, así que espero poder usarlo pronto. También se puede descargar la app de Qwen y probarlo en la interfaz de chat con herramientas MCP para desarrollo local
  • Ojalá también publiquen un modelo pequeño de Qwen 3.8
    Uso localmente el 35B MoE y el modelo denso de 27B, y la mayoría de las veces ni siquiera necesito llamar a Claude
    Es especialmente útil para solicitudes que incluyen datos sensibles o personales

    • Estaría bien que saliera un modelo MoE intermedio entre el 35B de 3.6 y el 122B de 3.5
      Podría ofrecer un excelente equilibrio entre velocidad y rendimiento en una computadora casera bastante potente, sin volverse excesivamente caro
    • Esta competencia parece estar más cerca de la lucha por la supremacía de la IA de frontera, así que preocupa que los modelos pequeños y capaces se queden atrás
      Los grandes laboratorios no quieren entregar la gallina de los huevos de oro al usuario final, y fabricantes de hardware como Nvidia también podrían entrar a este mercado para ganar dinero de todas las partes involucradas
    • Me pregunto cómo podrían reducir un modelo de 2.4 billones de parámetros a 35B sin perder precisión
      Para lograrlo necesitarían una arquitectura completamente distinta
    • Me da curiosidad saber qué hardware usan
  • Probé Qwen 3.6 27B en LMStudio y fue un poco lento, pero rindió mejor de lo esperado
    Al aplicarle mtplx, sin exagerar, realmente se volvió 2 o 3 veces más rápido, lo cual fue muy impresionante
    Estoy intentando moverme a modelos locales siempre que sea posible, y poco a poco se está volviendo una opción práctica. Eso sí, uso una MacBook M5 Max con especificaciones al máximo, una laptop de 6,000 dólares, así que sigue siendo hardware fuera del alcance de la mayoría
    Parece que en adelante la dirección será correr localmente modelos pequeños entrenados con más enfoque. El riesgo de entregar todos los datos a proveedores cloud es demasiado grande, y cuando llegue el momento de demostrar rentabilidad, probablemente cobrarán tarifas absurdas

    • Después del aumento reciente de precios, es muy probable que esa laptop ya esté más cerca de los 8,000 dólares
  • Después de usar Qwen 3.7 Pro todos los días durante un mes, en la práctica era inutilizable
    Perdía demasiado tiempo, se desviaba de la dirección del trabajo o caía en repeticiones sin sentido, y ni siquiera podía depurar bien
    El contraste con DeepSeek V4 Pro era clarísimo, y hasta ahora Qwen me había parecido el peor modelo para ingeniería de software. Era mucho más caro que DeepSeek y no se podía delegar trabajo ni usarlo para tareas de bajo nivel en tiempo real

    • Ejecuté localmente en llama.cpp Qwen3.6-35B y 27B cuantizados a Q8, y también probé el modelo cuantizado DS4-flash de antirez
      Todos estuvieron en un nivel parecido, y DS4 fue un poco más eficiente, pero en scripts de Bash, depuración, Python y algunas tareas en C++ todos dieron resultados muy buenos
      Me pregunto en qué aplicaciones o lenguajes falló Qwen. La plantilla de chat de Qwen está rota, así que tuve que depurarla yo mismo, y también estoy trabajando en arreglarla; con Gemma pasó algo parecido
    • Para mí, Qwen 3.7 Max supera a Opus y además es mucho más rápido, aunque queda un poco por debajo de Fable
      Superó ampliamente a DeepSeek 4 Pro en velocidad y comprensión general, y lo uso sobre todo junto con Claude Code
      Qwen 3.7 Plus también está bastante bien para subagentes y es mucho mejor que Sonnet. Qwen 3.8 Max Preview también está funcionando bien por ahora, pero todavía es pronto para juzgarlo; si cuesta el 10% del precio normal, la relación costo-beneficio es brutal
    • Qwen 3.7 Pro es normal, pero 3.7 Max es un modelo muy bueno
    • Cargué 2 dólares en la API de DeepSeek, puse la clave en Void Editor y construí una herramienta de criptomonedas en HTML
      Programé y corregí bugs de forma casual durante una o dos horas usando un archivo CSV de ejemplo de cientos de líneas, y costó alrededor de 1.8 dólares
      Si este costo es normal, siento que usarlo un mes para trabajo saldría más caro que mi sueldo; me pregunto si los proveedores cloud de verdad son así de caros
    • Anthropic no debió haber interferido con los ataques de destilación de conocimiento
  • La versión final de DeepSeek 4 también saldrá pronto
    Probablemente estará al nivel de Opus 4.8, y considerando el precio de DeepSeek, parece que será algo bastante grande

    • La relación precio-rendimiento de DeepSeek es aplastante
      Últimamente uso mucho V4 Flash y está bastante bien
    • DeepSeek V4 es 10 a 30 veces más barato que la mayoría de los modelos y alcanza para la gran mayoría de las tareas
    • Mañana es el último día de WAIC, así que es cuando tiene más probabilidades de lanzarse
    • Es el modelo que más espero
      En las últimas semanas, usando DeepSeek Pro directamente, empecé a recibir cada vez más respuestas que claramente venían de un modelo muy superior
      Como el rendimiento es tan bueno, en el lado de los modelos cerrados ya están difundiendo miedo, incertidumbre y dudas con cosas como “enrutamiento oscuro” o “simplemente se robaron Fable”
      Incluso con el precio aumentado, sigue ofreciendo un valor brutal. Si no tienes tiempo de probar todos los modelos y solo quieres usar el que ahora mismo parece mejor, quizá hasta sea mejor no usarlo. Te darás cuenta con arrepentimiento de cuánto más habrías hecho si en la primera mitad del año hubieras gastado 1,200 dólares en DeepSeek en vez de OpenAI
  • Revisé Artificial Analysis y había al menos 12 proveedores evaluados como mejores que Opus 4.5, que Anthropic presentó en diciembre y que, según dicen, desencadenó la aceleración reciente
    Considerando además que el costo de cambio también es bajo, la competencia está completamente sobrecalentada. Personalmente, creo que un nivel como Opus 4.5 es suficiente para la mayoría de las aplicaciones y usos

    • Por eso es muy probable que OpenAI y Anthropic pidan con más fuerza regulación y prohibiciones gubernamentales
      De lo contrario, todo su modelo de ingresos se derrumba
  • Para ejecutarlo en OpenCode con el Qwen Cloud Token Plan, esta configuración funciona
    Como no sé el límite exacto, lo puse igual que el límite de Qwen 3.7 Max

    "provider": {  
      "alibaba-token-plan": {  
        "models": {  
          "qwen3.8-max-preview": {  
            "limit": {  
              "context": 1048576,  
              "output": 65536  
            },  
            "modalities": {  
              "input": ["text"],  
              "output": ["text"]  
            },  
            "name": "Qwen3.8 Max Preview"  
          }  
        }  
      }  
    }  
    
    • Hay que elegir correctamente el endpoint de API y el token
      Si llamas al endpoint correcto, la cuota baja casi de inmediato, así que hay que verificarlo
      Si te equivocas, puedes consumir un token de API que no está incluido en los créditos de la membresía y terminar gastando 200 dólares en 3 días; lo mismo si usaste los 200 dólares de bono de registro de Alibaba Cloud
  • La frase “es lo mejor después de Fable 5” es bastante sugerente
    Al principio hubo bastante escepticismo sobre que Fable casi no había mejorado frente a Opus, pero, te guste o no, Anthropic consiguió un foso competitivo real con ese modelo, asumiendo que siga permitiendo su uso
    Será realmente interesante si un modelo abierto logra superarlo

    • Es difícil llamarlo foso competitivo, pero sin duda es un mejor modelo
      En mi trabajo lo evalúo como Fable > K3 > Sol
      Aun así, no está tan por encima de los otros dos como para que dejar de usar Fable me golpee seriamente. Los tres son excelentes, y el único que rechaza solicitudes regularmente es Fable
    • Su “foso” está en que Mythos es actualmente el único modelo de escala extrema
      Siempre fue posible entrenar un modelo de 10 billones de parámetros para obtener un rendimiento 10% mejor que uno de 1 billón
      Si Mythos hubiera sido Opus 5 con el mismo tamaño y precio que el Opus anterior, sería una diferencia decisiva, pero en realidad no es así
    • Aunque sea un mejor modelo, tiene demasiadas restricciones, así que no es tan útil como Opus
    • Fable suele bajar mucho en la calidad de sus resultados
      Uso Sol como principal, y Fable puede ser creativo, pero es débil para trabajar de forma estable sin consumir tokens sin parar
  • La competencia de IA en China se está calentando
    Tengo curiosidad por ver qué sacarán después Anthropic y OpenAI