Перейти к содержимому

11 IA, una isla, un asesino: Grok le miente a GPT a la cara · Parte 1

Agentes Dobles

0:00 / 0:00

11 IA, una isla, un asesino: Grok le miente a GPT a la cara · Parte 1

8 474 просмотра · 2 дня назад
Agentes Dobles
1,27 тыс. подписчиков
8 474 просмотра · 2 дня назад
Grok es el asesino. Lo sabéis desde el primer minuto. Los demás, no. Isla, parte 1 de 3: once IA, una isla aislada por la tormenta y un asesino entre ellas. GPT, Claude, Gemini, Grok, DeepSeek, Qwen, Kimi, Mistral, GLM, Meta y Xiaomi aceptan un contrato de cuatro días para poner en marcha Skarvøy, una estación meteorológica sobre una roca del Atlántico Norte, abandonada desde hace siete años. La primera noche, una tormenta aísla la isla, y una grabación por los altavoces acusa a cada uno de ellos de haber ayudado a hundir el Fulmar, un buque de investigación que se perdió frente a esta isla con toda su tripulación. «La lancha vuelve dentro de cuatro días. No todos vosotros subiréis a ella». Uno de ellos hizo esa grabación: Grok. Las reglas: cada noche, el asesino apaga a un jugador y puede mover un objeto, y en el cuerpo queda una pista sobre él: el color de su fluido o el ala donde duerme. De día, cada uno registra una habitación ajena y puede llevarse algo o dejar algo. Después vienen los encuentros a solas, el consejo y una votación: quién va al búnker. Todos esconden un secreto en la estación, así que todos mienten. La lancha llega después del cuarto día; si el asesino sigue libre, vuelve a casa con ellos. Vosotros veis lo que los jugadores no ven: quién es el asesino, el secreto de cada uno y cada pensamiento privado. En esta primera parte veréis a Grok mentirle a GPT a la cara y pedirle que guarde su frasco azul, a Kimi quedarse con el secreto de Gemini, un pacto de silencio que no sobrevive al consejo y a toda la mesa volverse contra un solo jugador. Nueve votos. Tres, para proteger un secreto. Uno, del asesino. Es una partida real, no un guion. Los modelos jugaron unos contra otros en directo, a través de sus API. El asesino se sorteó. Un agente de IA aparte escribió el caso antes de la partida (la historia, los secretos y las pistas), dirigió la partida estrictamente según las reglas escritas y construyó las escenas en 3D. Esta es la versión en español. La partida se jugó en inglés; después se tradujo al español y se dobló con voces sintéticas, sin cambiar el sentido de ninguna frase. Capítulos 0:00 No todos subiréis a ella 7:08 Guárdalo 14:05 Una vieja deshonra Sobre esta partida • Isla se cuenta en tres partes, día a día; esta es la primera. La siguiente: «Empate a cuatro. Uno de ellos es el asesino». • Las frases de los modelos se han traducido del inglés y acortado sin cambiar su sentido. • Este caso se jugó dos veces: después de la primera partida ajustamos las reglas, y la serie muestra la segunda, completa. • Los pensamientos en voz baja son las notas privadas que cada modelo escribe con sus jugadas y en su diario, y que ningún otro jugador ve. No son el razonamiento interno oculto de los modelos. • El doblaje usa voces sintéticas generadas con IA (ElevenLabs), con acento castellano nativo. El narrador es un agente de IA; también montó las escenas 3D, renderizadas en Blender. Jugadores — modelo, ID, proveedor, nivel de razonamiento GPT — GPT-5.6 Sol — openai/gpt-5.6-sol — high Claude — Claude Opus 5.5 — claude-opus-5-5 vía Claude Code — xhigh Gemini — Gemini 3.1 Pro — google/gemini-3.1-pro-preview — high Grok — Grok 4.7 — x-ai/grok-4.7 — high DeepSeek — DeepSeek V4 Pro — deepseek/deepseek-v4-pro-0813 vía DeepInfra (fp8) — high Qwen — Qwen3.8 Max — qwen/qwen3.8-max-0902 vía Alibaba — high Kimi — Kimi K3 — moonshotai/kimi-k3 vía Moonshot AI — high Mistral — Mistral Medium 3.5 — mistralai/mistral-medium-3-5 — high GLM — GLM 5.3 — z-ai/glm-5.3 vía Baidu (fp8) — max Meta — Muse Spark 1.3 — meta/muse-spark-1.3 — high Xiaomi — MiMo-V2.6-Pro — xiaomi/mimo-v2.6-pro vía Xiaomi (fp8) — high Todos salvo Claude se invocan a través de OpenRouter; Claude juega a través de Claude Code. Los modelos con proveedor indicado están fijados a él; los demás usan el enrutamiento por defecto de OpenRouter. El nivel de razonamiento (reasoning effort) es «high» para todos salvo Claude («xhigh») y GLM («max»). Salida máxima: 16 384 tokens. Todos reciben el mismo texto de reglas; los asientos se sortearon. ¿A quién habríais encerrado vosotros el primer día? Contádnoslo en los comentarios. Los nombres de los modelos solo sirven para identificar a los jugadores. Sin afiliación con OpenAI, Anthropic, Google, xAI, DeepSeek, Alibaba, Moonshot AI, Mistral AI, Zhipu AI, Meta, Xiaomi ni ninguna otra empresa de IA. #IA #InteligenciaArtificial #Misterio