Probé Modelos de IA Locales con Acertijos Difíciles | ¿Cuál es Más Inteligente?
ANGELO TUTORIAL
0:00 / 0:00
Probé Modelos de IA Locales con Acertijos Difíciles | ¿Cuál es Más Inteligente?
11 просмотров · 1 день назад
ANGELO TUTORIAL
6,91 тыс. подписчиков
11 просмотров · 1 день назад
¿Son los modelos de inteligencia artificial locales realmente capaces de razonar bajo presión o solo memorizan patrones? En este video ponemos a prueba varios modelos de lenguaje ejecutados 100% en local a través de LM Studio, enfrentándolos a acertijos de lógica complejos y preguntas con trampa.
Evaluamos el comportamiento de diferentes tamaños y arquitecturas, analizando la velocidad de generación (tokens por segundo), el consumo de VRAM/RAM, las alucinaciones comunes y su capacidad para detectar detalles sutiles en problemas de deducción temporal, aritmética y lógica deductiva.
⏱️ Marcas de tiempo (Capítulos):
00:00 – Introducción y planteamiento de las pruebas
00:41 – Modelos locales a evaluar (Qwen 3.8, Qwen 3 VL, Gemma y ultraligeros)
01:10 – Acertijo 1: El dilema del día de la semana
02:04 – Rendimiento de modelos destilados vs. Qwen 3 VL (8B)
04:26 – Evaluando Gemma 2B y limitaciones de modelos pequeños
07:51 – Segunda ronda y verificación de consistencia en Qwen 3 VL
08:18 – Acertijo 2: El clásico problema del corcho y la botella (Aritmética)
09:37 – Resultados de velocidad y tokens por segundo en modelos ligeros
11:53 – Acertijo 3: La trampa del avión y los sobrevivientes en la frontera
13:54 – Alucinaciones de jurisdicción legal vs. deducción real
16:10 – Prueba final y conclusiones: ¿Cuál fue el modelo ganador?
📌 Modelos evaluados en el video:
Qwen 3.8 (Versiones destiladas de 2B, 4B y 9B)
Qwen 3 VL (8B – Modelo de Visión y Lenguaje)
Gemma (2B)
Modelos compactos y ultraligeros (~300M - 450M parámetros)
📁 Recursos y archivos:
https://drive.google.com/drive/folder...
☕ Apoya los proyectos en Ko-fi:
https://ko-fi.com/angelotutorial
✉️ Correo electrónico de contacto:
angelogabrielgomez@gmail.com
🔔 No olvides suscribirte al canal, dejar tu like y comentar: ¿Qué modelo local utilizas tú para tus pruebas y cuál te ha dado mejor resultado en razonamiento?