Перейти к содержимому

なぜ8GBのノートPCで1250億のAIが動くのか|入らないまま動かすStrata【ゆっくり解説】

サルでもわかるAIにゅーす速報【ゆっくり解説】

0:00 / 0:00

なぜ8GBのノートPCで1250億のAIが動くのか|入らないまま動かすStrata【ゆっくり解説】

10 173 просмотра · 12 часов назад
サルでもわかるAIにゅーす速報【ゆっくり解説】
7,35 тыс. подписчиков
10 173 просмотра · 12 часов назад
80GBあるモデルが、12GBのグラボ1枚で返事を書いている。 算数が合っていません。入れたのではなく、入らないまま動かしているからです。 答えは「置き場所を3段に分けること」でした。 よく使う専門家をグラボに、全部をパソコンのメモリに、索引をSSDに。 図書館の机・書架・目録にたとえて、最初から最後まで通して解きます。 そして本当に効くのは、グラボではなくメモリでした。 買い替えようとしている人は、いったん止まってから見てください。 この回で分かること ・なぜ80GBのモデルが、12GBのグラボ1枚で動いてしまうのか ・実際のところ、いくらの機材が本当に必要になるのか ・入りきらないのに、本家と同じ答えが返ってくると言えるのか 数字はすべて、配布側の発表と、本日公開された個人の実測報告から取りました。 どれが「配布側の自己申告」で、どれが「他人が測った数字」なのかを、 動画の中でそのつど分けて話しています。 ■ 目次 0:00 80GBのAIが、12GBのグラボ1枚で動いている 2:25 配布側が出した数字と、今日出てきた実測 4:53 図書館でたとえる ── 机・書架・目録の3段 7:28 目録が探す時間を消す ── CPUも一緒に働く 10:06 投機デコード ── 助手が5冊まとめて持ってくる 12:36 効くのはグラボではなくメモリ 15:07 8GBか12GBか ── 機材の幅と文脈の長さ 17:23 本家と同じ答えが返るのか ── 書かれている4つの制限 19:49 ライセンスは2つ ── 両方の言い分を並べる 22:18 買い物の順番が変わる ── 向く人と向かない人 ■ この動画について 今日の動画は、公開されている一次資料と本日の実測報告をもとに、 独自に調査した内容で構成しています。図解もすべて独自に作成しています。 配布側の自己申告と第三者の評価は、動画の中で分けて扱っています。 結論は1つに断定していません。速さは確かめられていますが、 答えの質を独立に測った人は、今日の時点ではまだいないためです。 ■ コメントで教えてください ・あなたが最初に「動かすのを諦めた」モデルは何でしたか。型番で教えてください ・8GBのグラボで動かせた人がいたら、その結果も知りたいです ■ 引用・出典 ・Strata(推論エンジン / MIT License) GitHub https://github.com/Niko1221/Strata (2026-10-01取得) ・Strata 配布側の論文 https://github.com/Niko1221/Strata/bl... (2026-10-01取得) ・AlphaSignal「Strata runs a 125B AI model on a regular gaming PC」(2026-09-28) https://alphasignal.ai/news/strata-ru... (2026-10-01取得) ・Lukas Stepanek「Memory-Sovereign Inference: Output-Exact Execution Beyond Full Residency」 arXiv:2608.23805 https://arxiv.org/abs/2608.23805 (2026-10-01取得。Strataの論文ではありません) ・@Yacamochi_db の実測報告(RTX 5090 単騎) https://x.com/Yacamochi_db/status/210... (2026-10-01取得) ・@Tono_Ken3 の実測報告(RTX 4060 8GB ノート) https://x.com/Tono_Ken3/status/210552... (2026-10-01取得) ・@ItsmeAjayKV の実測報告 https://x.com/ItsmeAjayKV/status/2105... (2026-10-01取得) ・@UtaAoya の投稿 https://x.com/UtaAoya/status/21051088... (2026-10-01取得) ・@TeksEdge の実測報告(12GB GPU / NVLink不要) https://x.com/TeksEdge/status/2105115... (2026-10-01取得) ・@_ryu15_ の投稿(反対側の言い分) https://x.com/_ryu15_/status/21055633... (2026-10-01取得) ・Qwen3.8-Flash-Next 本体のライセンスは Qwen Community License です(エンジンのMITとは別です) ■ 使用素材 東方Project 二次創作(霊夢・魔理沙の立ち絵) 音声合成:AquesTalk / YMM4(ゆっくりMovieMaker4) #ゆっくり解説 #AI #ローカルLLM #Qwen #Strata #オープンウェイト #生成AI #GPU #グラボ #メモリ #自作PC #LLM