Alibaba publicó en agosto un modelo de 27B que obtiene 52 en el índice de Artificial Analysis frente a los 38 de su antecesor, con una red idéntica. Qué significa eso para correr un modelo capaz en una sola tarjeta gráfica, y cuánto cuesta en memoria y en tokens.
Los cuatro mejores modelos del índice de Artificial Analysis están a cuatro puntos entre sí y su costo por tarea varía el triple. El más barato es el que puedes descargar. Lo que cambió en julio fue el poder de fijar precios, no la capacidad.
NVIDIA, Microsoft, Meta y otras 22 firmaron una carta que sostiene que Estados Unidos no debe restringir los modelos descargables. Leímos las tres páginas, verificamos con nuestro propio trabajo la única afirmación que podemos comprobar y anotamos lo que la carta evita.
El hardware para sostener un modelo capaz se volvió barato, y los modelos se hicieron lo bastante pequeños para caber. Qué corre en las máquinas de tu cuarto, y los dos números que lo deciden.
El blog de ingeniería de Anthropic describe cómo construir agentes en producción. agent-stdlib empaqueta esos procedimientos en skills instalables, servidores MCP y hooks de seguridad que puedes ejecutar en cualquier harness.
El código de este sitio es un repositorio público de GitHub, y también lo es el resto de nuestro stack. El argumento práctico para construir sobre open source.
Construimos nuestro sitio de producción con Qwen3.6-27B, un modelo open-source de Alibaba. Qué pueden hacer hoy los modelos open-weight de frontera, y dónde todavía necesitas a una persona en el proceso.