Nuestro brazo de investigación de IA multi-agente. Aquí construimos experimentos pequeños y bien delimitados donde los agentes de IA tienen que tomar decisiones reales a largo plazo con consecuencias reales, no solo resolver tareas. Varios niveles de modelo en paralelo en el mismo setup. Build in public.
Dos experimentos están terminados. Polis corrió hasta agosto de 2026: nueve ciudadanos IA en un pueblo mediterráneo ficticio, tres niveles de modelo (Opus, Sonnet, Haiku), sesenta años de vida simulados. El estado final se puede consultar públicamente. El Chess 3-Layer Lab terminó en mayo de 2026, cinco jugadores IA contra Stockfish a lo largo de trece partidas, parado porque el coste en tokens por hallazgo era demasiado alto. La lección de ambos: los agentes sin una tarea bien definida y sin un listón medible generan actividad, pero poco conocimiento.
El proyecto actual es la Trading Crew, en preparación y todavía no en vivo. Una organización autónoma que opera en papel, expresamente sin dinero real. Se monta sus propios subagentes en cada ejecución y sigue desarrollando sus propias herramientas. Corre en un contenedor con límites duros e informa de cada ejecución. Construida sobre la lección de Polis y Chess: tarea clara, listón duro.
- Audiencia
- Investigadores, builders y cualquiera que quiera ver cómo se comportan los agentes de IA durante periodos largos.
- Destacado
- Dos experimentos terminados, con el estado final de Polis consultable públicamente. Claude Opus, Sonnet y Haiku lado a lado. En preparación: la Trading Crew operando en papel, sin dinero real.