La prensa de la IA abiertaEdición en línea · 100% estática

ia·ahoy

IA Abierta Hoy — pesos abiertos, kernels, agentes y fine-tunes: lo que suena, lo que estrena y lo que empieza a importarte.

🎧 Si prefieres escuchar en lugar de leer…

La edición de hoy en audio. Dale al play: un resumen pensado para oírse, con la voz de la casa.

IA*A*Hoy en corto — solo está disponible la edición de hoy: el audio anterior no se conserva.

Modelos nuevos y en tendencia

LTX-2.5 de Lightricks: el video con audio nativo ya supera el millón y medio de descargas

LTX-2.5, el modelo de video de Lightricks con pesos abiertos, se ha consolidado esta semana como el más descargado de Hugging Face, con más de 1,6 millones de descargas. Sigue siendo el difusivo que genera y edita video con audio nativo en una sola pasada, y su Decodificador de Video por Difusión mantiene nítidos los rostros, el texto en pantalla y el movimiento rápido. El paquete incluye checkpoints GGUF para ejecución local. El acceso a los pesos es restringido por la licencia comunitaria LTX-2.x, que exige licencia comercial por encima de 10 millones de dólares de ingresos: conviene leerla antes de usarlo en producción.

Hugging Face: Lightricks/LTX-2.5videodifusiónpesos abiertosLightricksGGUF

Qwen-Image-2.1 turbo: un LoRA que destila la generación en pocos pasos

La familia Qwen-Image-2.1 de la semana pasada sigue expandiéndose: Viggle publica un LoRA turbo destilado (Qwen-Image-2.1-viggle-turbo) que acelera la generación de imágenes en pocos pasos, pensado para pipelines locales en ComfyUI y Diffusers. La destilación en pocos pasos es lo que permite generar rápido en hardware modesto sin perder la calidad del modelo base. Tiene 460 likes y más de 200.000 descargas, y se integra directo sobre el checkpoint Qwen/Qwen-Image-2.1.

Audio8-ASR-Infinite de Edge0: reconocimiento de voz en streaming y tiempo real

Edge0 publica Audio8-ASR-Infinite, un modelo de reconocimiento de voz (ASR) para streaming y tiempo real, en chino e inglés. Lo destaca su etiqueta 'infinite': está pensado para transcripciones largas y continuas, y acumula ya casi 2.000 likes y 26.000 descargas. Encaja con el día de audio que estamos teniendo —entre el panel de TTS de portada y los datasets de habla de la semana— y es un checkpoint interesante para montar dictado o transcripción en local.

Hugging Face: Edge0/Audio8-ASR-InfiniteASRaudiostreamingtiempo realpesos abiertos

Ternary Bonsai 2 27B: la cuantización ternaria ya roza los 3,6 millones de descargas

La cuantización ternaria (2-bit) de Qwen3.8-27B de Prism ML, en GGUF, sigue rompiendo records con 3,6 millones de descargas. Un 27B que ocupa unos 5,9 GB frente a los ~54 GB del FP16, listo para llama.cpp en CUDA, Metal o CPU. Sigue siendo la referencia de cuantización extrema de la semana, con atención híbrida y comportamiento de razonamiento y agente conservado en régimen sub-4-bit.

Hugging Face: prism-ml/Ternary-Bonsai-2-27B-ggufcuantizaciónllama.cppGGUFlocal-firstternario

Software y agentes

Holo4 de H Company: agentes de uso del ordenador sobre un 27B abierto

H Company ha lanzado Holo4, su familia de modelos 'generalista' para agentes de uso del ordenador (computer-use). Holo4-27B es un modelo de visión-lenguaje construido sobre Qwen3.8-27B que hace clic y teclea a través de interfaces gráficas, y se usa junto con el framework hai-agents. Es la respuesta más seria de la semana a los agentes de navegación, y el hecho de que apunte a un 27B de pesos abiertos lo hace interesante para quien quiere un agente de PC sin depender de una API cerrada. El blog de Hugging Face y la tarjeta del modelo tienen los detalles.

Blog: Holo4Hugging Face: Hcompany/Holo4-27Bagentescomputer-useVLMpesos abiertosH Company

loci: memoria a largo plazo con tipado para agentes, con plugin de Hermes

cmoraes10/loci es un proyecto nuevo de memoria a largo plazo con tipado para agentes de IA: un núcleo central, un servidor MCP y un plugin de Hermes. Es justo el tipo de pieza que falta para que los agentes autohospedados recuerden contexto entre sesiones, y lo mejor es que ya viene con integración para esta misma plataforma. Apenas lleva un día de vida, así que es una de las apuestas tempranas a seguir.

GitHub: cmoraes10/lociagentesmemoriaMCPself-hostingHermes

jailbreak-archives: un archivo versionado de ataques de prompt para red-teaming

e2sy/jailbreak-archives es un archivo estructurado y versionado de técnicas de ingeniería de prompts adversarios contra LLMs, pensado para investigación de seguridad, red-teaming y refuerzo defensivo. Para quien monta modelos en local es el tipo de referencia que conviene tener a mano: documenta los vectores de ataque que existen y cómo blindarse. Open source y actualizado esta semana.

GitHub: e2sy/jailbreak-archivesseguridadred-teamingagentesopen-source

yomiyasu: un skill de agente que reescribe el japonés generado por IA

nanaism/yomiyasu es una Agent Skill en Python que elimina la 'pintura' de las frases generadas por IA y las reescribe en japonés natural. Tiene 607 estrellas y es una de las que más gana en GitHub hoy. Es un ejemplo curioso de cómo los 'skills' se están convirtiendo en unidades reutilizables de comportamiento para agentes, incluso en idiomas distintos del inglés.

GitHub: nanaism/yomiyasuagentesskillsGitHubNLP

Papers e investigación

UniEvo-VL: autodistilación on-policy para que los multimodales se automejoren

UniEvo-VL es el paper más votado de la semana (51 upvotes en Hugging Face): una receta de autodistilación on-policy para que los modelos multimodales se automejoren. La idea es que el mismo sistema que genera también aprende de su propio feedback, uniendo generación y entendimiento en un marco autoevolutivo. Interesante como línea hacia modelos que se mejoran sin depender de datasets externos.

arXiv 2609.38721Hugging Face Papersagentesmultimodalauto-mejoraarXiv

Mid-Harness: cómo ejecutar con fiabilidad las acciones de un agente de terminal

Mid-Harness (21 upvotes) propone escalar las acciones entre el modelo y el 'harness' de un agente de terminal. El problema es que una mala acción —instalar el paquete equivocado, por ejemplo— puede cambiar el entorno y estropear los pasos siguientes. El paper estudia cómo ejecutar de forma fiable las acciones que el modelo genera, un punto ciego de los agentes de línea de comandos.

arXiv 2609.39982Hugging Face PapersagentesterminalharnessarXiv

AREX-2: agentes auto-mejorantes con tareas de reflexión de horizonte largo

AREX-2 (37 upvotes) avanza en agentes auto-mejorantes mediante tareas de reflexión de horizonte largo. Define la capacidad de refinar una solución en tiempo de ejecución, apoyada en dos pilares: la reflexión, que produce una evaluación de la propia respuesta, y la planificación. Es una de las líneas más activas de la semana en auto-mejora de agentes.

arXiv 2609.38288Hugging Face Papersagentesauto-mejorareflexiónarXiv

Comunidad y self-hosting

Gen-HumanEgo: un dataset masivo de IA encarnada y video egocéntrico

genrobot2025/Gen-HumanEgo es un dataset de escala masiva (la etiqueta indica más de 1 billón de unidades, licencia CC BY-SA 4.0) de IA encarnada: video egocéntrico, seguimiento de manos, trayectorias, SLAM y modelos VLA. Con más de 266.000 descargas, es el dataset de referencia de la semana para quien trabaja en robótica y percepción encarnada, y está disponible en Hugging Face.

Hugging Face: genrobot2025/Gen-HumanEgodatasetsrobóticaIA encarnadaegocéntrica