lunes, 27 de julio de 2026·light·short·9,054 tokens
🔥 TOP — lo que SÍ o SÍ tenés que ver
- Claude Opus 5 ya está acá — rendimiento cerca de Fable a la mitad del precio. El modelo más resistente a prompt injection hasta la fecha. Si usás Claude API, esto te cambia la ecuación costo/calidad ya. link
- Opus 5 es el modelo menos inyectable — Boris Cherny lo confirmó: en evaluaciones y red teaming, Opus 5 es significativamente más difícil de prompt injectar. link
- Guardianes de los Agentes: verificación estática para tool calls de Claude Code — Un plugin que intercepta llamadas (bash, read, edit, write) antes de ejecutarlas y las verifica con un sidecar en Python. Para cuando querés evitar que Claude Code rompa todo. link
- Jeffy Loop: loop autónomo de mejora de código para Claude Code — Un loop que hace que Claude Code se revise a sí mismo iterativamente. Ideal para entender patrones de agentic workflows. link
- Hook de 60 líneas para que Claude Code no te edite el .env — PreToolUse hook simple que protege archivos sensibles. Si laburás con Claude Code en producción, esto evita accidentes feos. link
📦 Claude / Anthropic ecosystem
- Claude Cookbooks oficiales de Anthropic — Una colección nueva de notebooks/recipes con snippets copiables para la API de Claude. Ideal para agarrar ideas rápido. link
- Cursor Bridge: corré Claude Code ilimitado con tu subscripción de Cursor — Un puente no oficial para usar Claude Code desde Cursor. Polémico (18 puntos, 20 comments en HN) pero útil si ya pagás Cursor. link
- Wattage: profiler de gasto de tokens para AI agents — Un gate de regresión de costos para agentes. Clave si querés entender cuánto te está costando cada loop de agente en producción. link
🛠️ Dev tools & coding
- T3 Code: GUI web minimalista para coding agents — Soporta Codex, Claude, Cursor y OpenCode. De Theo, si te copa el stack T3. link
- ego-lite: browser para AI agents que corre en paralelo — Un browser donde vos y tus agentes trabajan sin pisarse, corriendo tareas en "Spaces" separados. Compatible con Claude Code y Codex. link
- Alibaba OpenCodeReview: code review con pipeline híbrido (determinista + LLM) — Battle-tested a escala de Alibaba, con reglas built-in para NPE, thread-safety, XSS, SQL injection. Gratuito y open source. link
- Ruff v0.16.0: ahora 413 reglas por defecto — Saltó de 59 a 413 reglas default. Si usás Ruff, preparate para que tu CI se rompa. link
🏗️ Software engineering
- Por qué AI no reemplaza la arquitectura de software — la hace más valiosa — Un post que argumenta que cuanta más AI tengas, más importante es tener buena arquitectura. Directo al grano y relevante para el día a día. link
- Buzz de Block: workspace donde humanos y agentes comparten salas — Un workspace auto-hospedable donde personas y AI agents colaboran en el mismo "room". Interesante como patrón de diseño para sistemas multi-agente. link
- El mercado de reventa de tokens LLM — Investigación sobre cómo revenden tokens robados/abusados de free trials, principalmente desde China. Para entender los riesgos de seguridad si exponés APIs. link
📚 Vale la pena leer
- Anatomy of an LLM Judge: "the model writes, the judge measures" — Buen desglose de cómo funciona un LLM como evaluador. Directo a tu interés en sistemas multi-agente y evaluación. link
- Lo que se rompe en producción con AI workflows — Post de Indie Hackers que reproduce 30 fallos reales de AI en runtime y detecta patrones. Pragmático y aplicable a tu SaaS. link
💤 Skippeable pero conviene saber
- Impeccable: design language para AI coding agents — 23 comandos, 60 reglas deterministas para mejorar diseño frontend generado por AI. Si te molesta que Claude Code te genere UI fea, esto te puede servir. link
- Anti-AI nostalgia y el culto al pasado — Un take sensato sobre por qué romanticar el "antes" no ayuda. Nada groundbreaking, pero bien escrito. link
- Claudaholic: web para seguir updates de Claude — Un agregador de noticias sobre Claude. No reemplaza leer las fuentes directas, pero como backup sirve. link