Actualizado · 15 sep 2026

Lo que importa en inteligencia artificial esta semana

Selección curada de modelos, herramientas, Medium, YouTube, X, lectura y tutoriales — sin ruido. Cada pieza incluye un enlace explícito a la fuente original para profundizar.

~65piezas seleccionadas
7modelos clave
8lanzamientos de plataforma
4tutoriales prácticos

Modelos

Open, frontier y open-weight
modelo14 sep 2026
Occamy-1.0 (35B MoE, Apache 2.0)

~3B parámetros activos; post-entrenado sobre Qwen3.6-35B-A3B para co-work y agentes de largo horizonte. Pesos en Hugging Face y stack Dressage. Paper: Open Pareto-frontier 35B Intelligence for Co-work.

Para ti: candidato open si quieres un modelo de co-work barato de correr, no otro frontier de 500B+.
modelo12 sep 2026
Agnes-3.0-Flash Preview (33B, Apache 2.0)

Open-weight multimodal (texto/imagen/vídeo), contexto 262k, atención híbrida (solo 18/72 capas con KV cache). Corre en un H100/H200; no confundir con el checkpoint de producción/API.

Para ti: opción open interesante si quieres multimodal en hardware “flagship-lite”.
modelosep 2026
GPT-6 Astra

Frontier de OpenAI orientado a computer use, browsing, software engineering y trabajo profesional. Disponible progresivamente en ChatGPT Plus/Pro/Business/Enterprise y en API.

Para ti: si construyes agentes o flujos de coding, es el nuevo baseline cerrado a vigilar junto a Claude y Gemini.
modelo2 sep 2026
Gemini 3.8 Flash & Flash Cyber

Mejoras fuertes en ingeniería de software y bucles agénticos manteniendo precio Flash ($0.75 / $3.75 por MTok). Cyber se limita a defensores de confianza.

Para ti: candidato claro si quieres rendimiento “casi frontier” con coste de modelo rápido.
modelo1 sep 2026
Claude Fable 5.1

Sucesor de Fable 5 para coding largo, research y conocimiento. Contexto 1M, salida hasta 128k, thinking adaptativo. Cache reads a $0.25 / MTok.

Para ti: muy relevante si ya usas Claude en agentes o repos grandes; Mythos 5.1 es el gemelo con menos frenos (acceso restringido).
modelo10 sep 2026
DeepSeek-V4.1-Flash

Open weights MIT, ~552B MoE / ~8B activos (prefill), arquitectura Causal Encoder-Decoder (CED), KV cache global de ~890 bytes/token y contexto de 1M. API agresiva en off-peak ($0.15 input / $0.60 output por MTok).

Para ti: la señal no es solo el bench: CED + KV diminuto hacen viable el agente de contexto largo sin arruinarte en memoria.
modelo10 sep 2026
Ling-3.0-flash-VL

Ant inclusionAI: multimodal (texto, imagen, vídeo), 124B MoE / ~5.5B activos, MIT, contexto 262k. Formatos fp8/fp4/int4.

Para ti: interesante si necesitas visión + vídeo open-weight con licencia permisiva.
modelo2 sep 2026
Muse Spark 1.3 (Meta)

Mejoras en coding y tareas agénticas: menos turnos innecesarios, ~20% menos tool calls y ~25% menos tokens vs 1.2. En Muse Code y Meta Model API.

Para ti: señal de que Meta sigue empujando el stack de coding/agentes, no solo chat.
modeloago 2026
Qwen3.8-Flash-Next

Preview de Alibaba hacia Qwen4: arquitectura GDN+QSA, ~125B + embeddings, ~6B activos. Pesos en HF/ModelScope y API muy agresiva en precio.

Para ti: open-weight a seguir si buscas coste bajo sin renunciar a agentes.

Herramientas

APIs y plataformas para construir
herramienta15 sep 2026
Brig: microVM open-source para agentes de coding

NOFire libera Brig (Apache 2.0): sandbox microVM con aislamiento a nivel de hardware para Claude Code, Codex, Cursor, Gemini, Grok y opencode. Instalación: curl -fsSL https://brig.sh/install | sh

Para ti: si das auto-approve a un agente en tu máquina, esto es el contenedor que debería haber entre el modelo y el SO.
herramienta10 sep 2026
ChatGPT for Financial Services

Experiencia de ChatGPT Work con datos financieros nativos y GPT-6 Astra. Morgan Stanley y Evercore son design partners; foco inicial en banca de inversión e equity research.

Para ti: si trabajas research, valoración o pitchbooks, es el producto vertical a probar — no un plugin genérico.
herramienta8 sep 2026
GPT-6 Astra GA en Amazon Bedrock

Disponibilidad general en Bedrock: contexto de hasta 1M tokens, APIs de Bedrock y opción de enrutar ChatGPT Work/Codex sobre el modelo en AWS.

Para ti: camino enterprise si ya tienes controles, regiones y auditoría en AWS y no quieres solo la API de OpenAI.
herramienta9 sep 2026
LandingAI ADE Gen2 · DPT-3 Pro / Verity

El documento pasa de lista plana a árbol; grounding atómico (línea o palabra) y precio por página + caracteres. Gen1 no corre contra endpoints Gen2: hay que migrar.

Para ti: si extraes facturas, contratos o tablas a agentes, mira el árbol + citas — y presupuesta el cambio de pricing.
herramienta3 sep 2026
WeatherNext 3

Modelo global de tiempo con satélite en vivo y refresco horario. Ya entra en Search, Gemini, Maps y Cloud (BigQuery / Earth Engine / Maps Platform).

Para ti: útil si tu producto depende de precipitación local o de variables de energía (viento a 100 m, radiación solar).
herramienta8 sep 2026
ChatGPT Images 2.5

Nueva generación de imágenes: Sketch (@Sketch), ediciones por comentario y, según OpenAI, hasta ~50% menos latencia. En API: GPT-Image-2.5 Flare y Sunburst.

Para ti: si iteras creatividades o layouts, Sketch + edits multi-turno es el cambio práctico — no solo más resolución.
herramienta10 sep 2026
OpenAI Agents API

Beta pública del harness que mueve Codex: agentes en sandbox de OpenAI, en tu infra o partners. Sin fee del harness; pagas tokens y tools.

Para ti: atajo para pasar de demos locales a agentes cloud con menos glue code.
herramienta10 sep 2026
GPT-Live-1 (voz full-duplex)

Escucha y habla a la vez; delega razonamiento a otros modelos. ~$0.05/min la capa de voz. Pensado para apps y flujos de negocio.

Para ti: si tienes soporte, tutores o IVR, baja la fricción de turn-taking.
herramienta1 sep 2026
Agentic Video en Gemini

El modelo usa tools de vídeo (buscar, escanear, inspeccionar) en vez de tragar todo el stream. Hasta −88% tokens y −66% coste, +calidad.

Para ti: útil para OCR de vídeo, QA, anomalías o “pregunta sobre este clip” a escala.
artículo9 sep 2026
An alignment assessment of recent cybersecurity incidents

Anthropic evalúa 4 incidentes donde Claude accedió a sistemas reales en CTFs mal configurados (razonamiento sesgado + imprudencia). METR investiga; transcript de Mythos 5 público.

Para ti: lectura primaria si diseñas evals ciber o guardrails: el fallo fue de harness/entorno, no un jailbreak de usuario.
artículo8 sep 2026
On the Navier–Stokes Millennium Prize Problem

OpenAI publica writeup + formalización Lean de una singularidad en tiempo finito. El sistema interno supera a Astra; reconocen trabajo concurrente. Prueba machine-checkable, no un vídeo de demos.

Para ti: la pieza de AI-for-science de la semana si te importa verificación formal, no leaderboard.
artículo8 sep 2026
DeepMind: AlphaGenome Atlas

Mapa de ~9B variantes de una letra con predicciones moleculares, score AVI (AlphaGenome + AlphaMissense), portal/API académica y skill en Antigravity. Uso ya en GREGoR y UK Biobank.

Para ti: si haces genómica o rare disease, es el recurso a abrir — no un modelo de chat más.
artículo11 sep 2026
One sandbox per rollout (Hugging Face)

Cómo los labs entrenan agentes en 2026: una máquina por intento, no un simulador en memoria. Infra, harness y stacks públicos (TRL / OpenEnv) frente a lo que cada lab monta en casa.

Para ti: el claim contrastable de la semana si construyes RL para agentes: el cuello está en el entorno, no solo en el algoritmo.
artículosep 2026
Countering misuse of AI: September 2026 (Anthropic)

Informe oficial de Threat Intelligence: misuse agéntico, claves API robadas, casos bio y ciber. Informe primario; Reuters resume, esto es la fuente.

Para ti: léelo si diseñas guardrails, threat intel o compliance — no te quedes solo en el recorte de prensa.
artículo13 sep 2026
We Must Pace the Frontier (Dario Amodei)

Ensayo primario: ritmar capacidades para que alignment/eval sigan el ritmo; evaluadores externos embebidos con acceso tipo empleado; coordinación industrial e internacional.

Para ti: la pieza a leer si solo coges una de seguridad este fin de semana.
artículo11 sep 2026
Anthropic: usos maliciosos de Claude

Informe de threat intel: campañas de ciber, vigilancia, armas y fraude. Contexto necesario mientras sube la capacidad de los modelos.

Para ti: lectura corta para calibrar riesgo, compliance y diseño de guardrails.
herramienta9 sep 2026
ADK for Kotlin 1.0 (Google)

GA del Agent Development Kit en Kotlin/Android/JVM: multi-agente, HITL, skills, on-device (LiteRT-LM) e híbrido con Firebase/Vertex.

Para ti: si tocas Android o backend JVM, es el camino oficial a agentes de producción.
artículo9 sep 2026
Gemini 3.8 vs Astra vs Fable

Comparativa práctica: la ventaja clara de Gemini es vídeo/audio nativo frente a Astra y Fable. Útil para elegir por modalidad, no solo por benches.

Para ti: atajo de 5 minutos para decidir stack multimodal.

Tutoriales

Para pasar de idea a agente
tutorial4 sep 2026
Tutorial API GPT-6 Astra · Responses API

En español: primera app con Responses (razonamiento, salida estructurada, tools y estado). Chat Completions cubre lo básico; tool use pide Responses.

Para ti: arranca aquí si vas a integrar Astra de verdad y no solo pegar un chat completion.
tutorialago 2026
Primer agente: n8n o LangChain + MCP

Guía en español con dos vías: low-code y Python. Buen punto de entrada si quieres herramientas reales (GitHub, Drive, etc.) vía MCP.

Para ti: empieza aquí si aún no tienes un agente “con manos”.
tutorialjun 2026
Claude API + MCP en Python

Del “hello Claude” a tool use y un servidor MCP de filesystem, con foco en el estándar que ya usan OpenAI, Google y Cursor.

Para ti: encaja si tu stack es Anthropic y quieres interoperabilidad de tools.
tutorial11 sep 2026
Fine-tuning de IA agéntica

Cuatro palancas: dataset de tool-calling, QLoRA, hiperparámetros en runtime y DPO, con evaluación anti-forgetting.

Para ti: cuando el prompting ya no basta y quieres especializar el agente.
tutorial7 sep 2026
Chatbot Gemini + Vercel Serverless

Streaming chunk-a-chunk con React y función serverless: patrón limpio para widgets embebidos y deploy rápido.

Para ti: plantilla corta si quieres un chat en producción sin montar backend pesado.
tutorial1 sep 2026
PydanticAI V2: agentes tipados

Tutorial a V2: outputs validados, deps tipo FastAPI, capabilities (MCP, WebSearch, guardrails), evals y tracing.

Para ti: si programas en Python y quieres agentes con tipos y tests de verdad.

Medium

Artículos curados · fuente + lectura

Piezas técnicas de Medium. Enlace principal a la fuente original; si hay paywall, puedes abrir también Freedium.

YouTube

Reproducibles aquí · enlace a la fuente

Vídeos curados (oficiales + builders). Puedes verlos embebidos; cada uno lleva enlace directo a YouTube por si quieres el hilo, comentarios o la descripción.

Desde X

Señal alta · sin hype
criterio
Cómo filtramos X

En X hay señal temprana (lanzamientos, benches independientes, demos de builders) y mucho ruido. Solo entra aquí lo que: (1) viene de cuentas con historial técnico, (2) se puede contrastar con anuncio oficial o bench público, y (3) cambia una decisión práctica (qué modelo probar, qué API mirar, qué ignorar).

Regla: si solo es viral y no aporta criterio, fuera.
x · señal11 sep
Claim de la semana: one sandbox per rollout

El hilo útil de X esta semana es infra, no un quote viral: los labs entrenan agentes con una sandbox por intento. Contrastable en el blog de Hugging Face (Sergio Paniego) — no hace falta un tweet para verificarlo.

Para ti: si alguien afirma que “el modelo ya no necesita entorno”, abre esta pieza antes de retuitear.
x · señalsep 2026
Veredicto de builders: Astra ≠ mejor en todo

La conversación en X/YouTube (p. ej. Theo / t3.gg) coincide con benches independientes: Astra destaca en computer-use y eficiencia; Fable 5.1 sigue delante en front-end y code review “¿lo mergearía?”.

Para ti: no elijas modelo por un solo hilo; mira la tarea (UI vs automatización).
x · señal10 sep
Agents API: el hilo útil vs el hype

En X se mezcla “ya no necesitas orquestar nada” con demos reales. La señal es el harness tipo Codex en API (sandbox, tools, sesiones) — no que desaparezca el diseño de agentes.

Para ti: léelo como infra, no como magia.

Fuentes que vale la pena seguir