なぜ8GBのノートPCで1250億のAIが動くのか|入らないまま動かすStrata【ゆっくり解説】
サルでもわかるAIにゅーす速報【ゆっくり解説】
0:00 / 0:00
なぜ8GBのノートPCで1250億のAIが動くのか|入らないまま動かすStrata【ゆっくり解説】
10 173 просмотра · 12 часов назад
サルでもわかるAIにゅーす速報【ゆっくり解説】
7,35 тыс. подписчиков
10 173 просмотра · 12 часов назад
80GBあるモデルが、12GBのグラボ1枚で返事を書いている。
算数が合っていません。入れたのではなく、入らないまま動かしているからです。
答えは「置き場所を3段に分けること」でした。
よく使う専門家をグラボに、全部をパソコンのメモリに、索引をSSDに。
図書館の机・書架・目録にたとえて、最初から最後まで通して解きます。
そして本当に効くのは、グラボではなくメモリでした。
買い替えようとしている人は、いったん止まってから見てください。
この回で分かること
・なぜ80GBのモデルが、12GBのグラボ1枚で動いてしまうのか
・実際のところ、いくらの機材が本当に必要になるのか
・入りきらないのに、本家と同じ答えが返ってくると言えるのか
数字はすべて、配布側の発表と、本日公開された個人の実測報告から取りました。
どれが「配布側の自己申告」で、どれが「他人が測った数字」なのかを、
動画の中でそのつど分けて話しています。
■ 目次
0:00 80GBのAIが、12GBのグラボ1枚で動いている
2:25 配布側が出した数字と、今日出てきた実測
4:53 図書館でたとえる ── 机・書架・目録の3段
7:28 目録が探す時間を消す ── CPUも一緒に働く
10:06 投機デコード ── 助手が5冊まとめて持ってくる
12:36 効くのはグラボではなくメモリ
15:07 8GBか12GBか ── 機材の幅と文脈の長さ
17:23 本家と同じ答えが返るのか ── 書かれている4つの制限
19:49 ライセンスは2つ ── 両方の言い分を並べる
22:18 買い物の順番が変わる ── 向く人と向かない人
■ この動画について
今日の動画は、公開されている一次資料と本日の実測報告をもとに、
独自に調査した内容で構成しています。図解もすべて独自に作成しています。
配布側の自己申告と第三者の評価は、動画の中で分けて扱っています。
結論は1つに断定していません。速さは確かめられていますが、
答えの質を独立に測った人は、今日の時点ではまだいないためです。
■ コメントで教えてください
・あなたが最初に「動かすのを諦めた」モデルは何でしたか。型番で教えてください
・8GBのグラボで動かせた人がいたら、その結果も知りたいです
■ 引用・出典
・Strata(推論エンジン / MIT License) GitHub https://github.com/Niko1221/Strata (2026-10-01取得)
・Strata 配布側の論文 https://github.com/Niko1221/Strata/bl... (2026-10-01取得)
・AlphaSignal「Strata runs a 125B AI model on a regular gaming PC」(2026-09-28)
https://alphasignal.ai/news/strata-ru... (2026-10-01取得)
・Lukas Stepanek「Memory-Sovereign Inference: Output-Exact Execution Beyond Full Residency」
arXiv:2608.23805 https://arxiv.org/abs/2608.23805 (2026-10-01取得。Strataの論文ではありません)
・@Yacamochi_db の実測報告(RTX 5090 単騎) https://x.com/Yacamochi_db/status/210... (2026-10-01取得)
・@Tono_Ken3 の実測報告(RTX 4060 8GB ノート) https://x.com/Tono_Ken3/status/210552... (2026-10-01取得)
・@ItsmeAjayKV の実測報告 https://x.com/ItsmeAjayKV/status/2105... (2026-10-01取得)
・@UtaAoya の投稿 https://x.com/UtaAoya/status/21051088... (2026-10-01取得)
・@TeksEdge の実測報告(12GB GPU / NVLink不要) https://x.com/TeksEdge/status/2105115... (2026-10-01取得)
・@_ryu15_ の投稿(反対側の言い分) https://x.com/_ryu15_/status/21055633... (2026-10-01取得)
・Qwen3.8-Flash-Next 本体のライセンスは Qwen Community License です(エンジンのMITとは別です)
■ 使用素材
東方Project 二次創作(霊夢・魔理沙の立ち絵)
音声合成:AquesTalk / YMM4(ゆっくりMovieMaker4)
#ゆっくり解説 #AI #ローカルLLM #Qwen #Strata #オープンウェイト #生成AI #GPU #グラボ #メモリ #自作PC #LLM