Boletín · domingo 9 ago 2026
El stack agentico se separa en cuatro capas y el auditor llega al grafo
TauricResearch/TradingAgents ↗
Framework Python basado en el paper arXiv 2412.20138 que monta un consejo de agentes LLM (analistas fundamental, sentiment, news y técnico, más un risk manager) que debaten y emiten operaciones de trading en cadenas reales, con backtests sobre datos históricos.
XYZ-AI-Lab/AxisAgentic ↗
Framework Python (Apache-2.0, paper propio en xyz-lab.ai) que ofrece un runtime extensible para agents de larga duración: multi-turn execution, tool orchestration, context management, recovery y benchmark evaluation. Cada trace preserva el estado visible por el modelo para soportar replay, evaluación o exportación SFT filtrada.
shepherd-agents/shepherd ↗
Runtime Python (MIT, alpha, paper arXiv 2605.10913) que graba la ejecución de un agent como un trace durable e inspeccionable, con workspace outputs retenidos. Un meta-agent puede forkear, hacer replay, revertir o aplicar cambios de forma selectiva. Sandboxing a nivel de SO vía Seatbelt (macOS) y Landlock (Linux).
Panniantong/Agent-Reach ↗
Wrapper Python (MIT, 69k★ en 5 meses) que da a los coding agents capacidad de lectura y búsqueda sobre las plataformas que más consume el público chino: Twitter, Reddit, YouTube, GitHub, Bilibili y XiaoHongShu. Encapsula el conocimiento de 'qué API funciona hoy, cuál se rompió y cuál necesita cookies'.
ShawnPana/phone-harness ↗
Harness Python minimalista (MIT, 358★, creado hace 2 días) que conecta un LLM directamente al iPhone vía macOS iPhone Mirroring: screencapture + Vision OCR como 'ojos', HID-level CGEvents como 'manos'. El agente escribe su propio helper Python en agent-workspace/agent_helpers.py durante la ejecución.
ifixai-ai/iFixAi ↗
Suite Python (Apache-2.0, 7.5k★, 1671 tareas en 24 áreas de práctica legal) que ejecuta inspecciones automatizadas sobre el comportamiento de un agent — el propio agent o uno externo — y devuelve un scoring reproducible. Se ejecuta como CLI, servidor o librería.
Egonex-AI/Understand-Anything ↗
Pipeline TypeScript (MIT, 78k★ en 5 meses) que toma cualquier codebase, knowledge base o docs y lo convierte en un grafo de conocimiento interactivo, explorable, buscable y consultable. Compatible con Claude Code, Codex, Cursor, Copilot y Gemini CLI.
Benchmark open-source para evaluar AI agents en trabajo legal realista (24 áreas de práctica, 1671 tareas). De Harvey, la startup legal-AI con $5B de valuation.
Toolkit Python (MIT, Microsoft) con policy enforcement, zero-trust identity, sandboxing y release approvals para AI agents. OpenSSF Scorecard integrado.
Cliente CLI en TypeScript para Hindsight (memoria vectorial). AI coding agent para terminal con hash-anchored edits, LSP y soporte Python. Mismo autor que pi (85k★).
Swarm intelligence engine: miles de agents con memoria ejecutan simulaciones sociales para predecir outcomes a partir de semillas reales (news, signals financieras). Patrón 'rehearse-the-future'.
Open-source frontier voice AI de Microsoft (52k★, MIT). Ya referenciado en el grafo, re-trending.
Browser verdaderamente independiente de Andreas Kling (creado en 2024, BSD-2, sin Chromium ni WebKit). Trending hoy por impulso general.
TTS que cabe en CPU y bolsillo (Kyutai, MIT). 100M de parámetros, corre en laptop sin GPU.
Convergencia con tu stack
Cruzado con tu grafo
Tendencias (5-6 boletines)
Resumen ejecutivo del boletín origen
- El stack de runtime de los coding agents se está separando en 4 capas especializadas: substrate (agent-substrate), trajectory/trace (AxisAgentic, Shepherd), governance/audit (iFixAi, MS Agent Governance Toolkit) y code intelligence graph (code-review-graph, lean-ctx, Understand Anything, semantica). Cada capa tiene un nuevo contendiente hoy. Es el eje editorial del boletín.
- TradingAgents como prueba académica de multi-agent en producción: 96k★, paper arXiv 2412.20138, 7 meses trending. El patrón 'analyst council' (5 analistas LLM que debaten y emiten trades) demuestra que el multi-agent con roles especializados funciona en dominios cuantitativos. Harvey LAB (legal) sigue la misma idea. La pregunta es si el patrón se generaliza.
- El smartphone se vuelve herramienta de agente:
ShawnPana/phone-harness(2 días, 358★) demuestra que con macOS iPhone Mirroring + Vision OCR + CGEvents HID, un coding agent puede operar un iPhone real sin jailbreak. Es el ejemplo más limpio de 'phone-as-agent-tool'. - Audit y governance se profesionalizan: Microsoft agent-governance-toolkit (5.8k★) y iFixAi (7.5k★) cubren los dos ángulos del problema — policy engine + zero-trust identity vs inspección estructurada de comportamiento. Complementarios, no redundantes.
- Internet-access layer para agents sube como categoría:
Panniantong/Agent-Reach(69k★ en 5 meses) encapsula el acceso a Twitter/Reddit/YouTube/Bilibili/XHS para coding agents. El dolor resuelto es real (APIs rompen constantemente) aunque el repo esté muy enfocado a China. - Fuentes consultadas: Trendshift daily, GitHub Trending daily, GitHub Trending TypeScript/Python/Rust/Go, GitHub API cuando aplica.
Edges del grafo (109)
…y 49 edges más