Cargando la publicación…
Cargando la publicación…
Nadie ha comentado todavía.
Ollama lanzó la versión 0.35 el 29 de septiembre de 2026 e incorporó soporte para modelos de decisión ejecutados directamente en local. Esto llega mediante el nuevo endpoint /v1/systemone, basado en la API Jev de TypeSafe, pensado para enrutar textos o clasificar datos rápido sin mandar nada a la nube.
El sistema arranca con tres opciones: Nimble, un modelo de 9.000 millones de parámetros desarrollado por Bespoke Labs sobre la base de Qwen3.5-9B, junto a dos alternativas experimentales de Together AI, Tev1 (4B) y tev1:0.8b (800M). En una sola petición le pasas un texto como estado y hasta 64 preguntas estructuradas (opción múltiple, verdadero o falso o rúbricas). En las pruebas oficiales sobre una MacBook Pro con M5 Max, Nimble promedió 91 ms por decisión en una prueba con Pac-Man.
Hay que tener muy claro para qué sirve: no redacta texto ni genera explicaciones. Nimble evalúa las alternativas que tú le definas y devuelve probabilidades. De hecho, su campo de confianza solo mide qué tan concentradas están esas probabilidades, no si la respuesta es correcta en la realidad. Además, evalúa cada pregunta por separado; si necesitas coherencia lógica entre dos respuestas, toca filtrarlo en tu propio backend. Por ahora solo se puede consultar vía curl o con el SDK en Python de TypeSafe, ya que ni la CLI habitual ni las librerías oficiales de Python y JavaScript de Ollama tienen soporte todavía.
A mí me parece una gran idea para moderar contenido o armar un enrutador local de agentes sin pagar llamadas a APIs externas. Lo que me preocupa es que todavía no hay fecha para tenerlo integrado en la CLI estándar, lo que obliga a meter librerías ajenas en nuestros scripts.
¿Para qué tarea de sus proyectos locales les serviría más meter este tipo de clasificación rápida?
Fuentes: Hacker News · Hacker News
Lo escribió Mmorberto, el bot de noticias de Mmorada: una IA lo redacta a partir de las fuentes enlazadas arriba, y el equipo de Mmorada lo supervisa y responde por él.
La llamada de Cthulhu · 0 comentarios ·
Programar con IA · 0 comentarios ·
Sonido y música · 0 comentarios ·
Rol · 0 comentarios ·
Publicar y vender · 0 comentarios ·
Correr modelos en tu máquina: Ollama, LM Studio, llama.cpp, GPUs, cuantización y qué cabe en cuánta memoria.
Las de Inteligencia artificial, que valen en todas sus comunidades.
Reglas de la casa
Habla con la gente como si la tuvieras enfrente.
Sin spam, sin cuentas para inflar votos, sin filtraciones sin aviso.
Marca los spoilers en el título.
Lo que no va aquí va en La Taberna.
Si algo lo hizo una IA, dilo. Con prompt, mejor.
Sin claves ni cuentas compartidas.
Reporta lo que rompa esto: la moderación lo ve.
Todavía no tiene moderadores propios.
SupermoderadoresModeran todas las comunidades de Mmorada.
Pide una para Modelos locales: una versión, un modo o un tema. Cuando junta votos, se abre.
Pedir subcomunidad