Перейти к содержимому

なぜ同じAIが機械を替えるだけで8倍速くなるのか|RTX 5090の2万4000倍【ゆっくり解説】

サルでもわかるAIにゅーす速報【ゆっくり解説】

0:00 / 0:00

なぜ同じAIが機械を替えるだけで8倍速くなるのか|RTX 5090の2万4000倍【ゆっくり解説】

827 просмотров · 3 часа назад
サルでもわかるAIにゅーす速報【ゆっくり解説】
7,31 тыс. подписчиков
827 просмотров · 3 часа назад
2026年9月29日のDevDayで、OpenAIが「Ultrafast」という速さの上位プランを出しました。 同じGPT-6 Astraが、Codexで最大8倍・毎秒300トークンまで速くなります。 ところが報道によると、APIの値段のほうもきっちり6倍になります。 中身を賢くしたわけでも、新しいモデルを出したわけでもありません。 重みも学習も何ひとつ変わっていない。変わったのは「動かす機械」のほうです。 この動画では、その機械の正体と、速さと値段がきれいに比例してしまう理由を、 台所の比喩(冷蔵庫・廊下・調理台)で最後まで解きます。 そして最後に、この話をそのまま自分のパソコンへ持ち帰ります。 手元のグラボが毎秒何文字出せるかは、割り算ひとつで先に分かります。 ■ この動画で分かること ・「8倍」と「6倍」── 同じ6という数字が、速さと値段の両方に出てくるからくり ・1文字出すたびにモデルの重みを全部読み直しているという、AIの本当の仕組み ・速さを決めているのは計算の力ではなく「メモリ帯域」であること ・Cerebrasのウェハースケール・プロセッサ(オンチップSRAM 44GB / 毎秒43.2ペタバイト) ・なぜ8月は14倍・毎秒750トークンだったのに、今回は8倍・毎秒300トークンに落ちたのか ・値段6倍の意味 ── Fastモード(値段2倍で速さ2.5倍)と並べると何が見えるか ・自分のグラボで毎秒何文字出るかを計算する方法(帯域 ÷ モデルの大きさ) ・VRAMが多いほど速い、は間違い ── パラメータが4倍多いほうが4倍速かった実測 ■ 目次 0:00 きょうの話 ── 8倍速くなって、値段も6倍になった 1:43 Ultrafastとは何か ── 同じモデルを速い窓口で動かす券 3:20 値段6倍の中身と、速さが効く仕事 4:55 25倍であって50倍ではない ── プランに仕込まれたわな 6:19 1文字出すたびに、重みを全部読み直している 8:37 速さを決めるのはメモリ帯域 ── 割り算1つで上限が出る 10:41 廊下をなくした机 ── Cerebrasのウェハーと毎秒43.2ペタバイト 13:14 欠陥が出る前提で作る ── 750メガワットの提携 14:56 なぜ8月の14倍が、今回は8倍に落ちたのか 17:01 賢いまま速くする ── 落ちた理由を公式は説明していない 18:53 値段が6倍になる理由 ── Fastと並べて分かること 20:57 家のパソコンの速さを、自分で計算する 22:54 VRAMが多いほど速い、は間違い ── 量子化という手 24:31 RTX 5090の実売と、きょうのまとめ ■ この動画で出てくる主な数字 ・GPT-6 Astra Ultrafast … Codexで最大8倍・毎秒300トークン / APIで最大6倍(OpenAI公式) ・APIの値段 … 入力100万トークン60ドル / 出力100万トークン300ドル(標準の6倍。報道) ・Pro 500 … 月500ドル。上限はPlusの25倍(50倍ではない) ・Cerebras WSE-3 Turbo … 面積46,225平方ミリメートル / オンチップSRAM 44GB / 毎秒43.2ペタバイト ・RTX 5090 … 毎秒1,792GB(Cerebrasとの差は約2万4000倍) ・RTX 5060 Ti … 毎秒448GB。10GBのモデルなら毎秒およそ45文字が上限 ■ 断っておくこと ・値段が6倍という数字は、OpenAIの価格ページでは確認できていません。独立した2媒体の報道が一致している段階です ・「GPU比15倍」「B300比56倍」はいずれもCerebras自身の主張で、第三者の測定ではありません ・14倍から8倍へ落ちた理由をOpenAIは説明していません。動画で述べた説明は、3つのモデルの実測が階段になっていることからの推論です ・750メガワットの世帯換算は、一般家庭の年間消費電力を4,300kWhとした投稿者の試算です。公式の数字ではありません この動画は独自に調査した内容をもとに作成しています。図解も独自に作成しています。 ■ 引用・出典 ・OpenAI「DevDay 2026 Recap」 https://openai.com/index/devday-2026-... (2026-09-30取得) ・OpenAI「Previewing Ultrafast mode: GPT-5.6 Sol at up to 14X the speed」 https://openai.com/index/previewing-u... (2026-09-30取得) ・OpenAI「OpenAI partners with Cerebras」 https://openai.com/index/cerebras-par... (2026-09-30取得) ・Cerebras「OpenAI Partners with Cerebras to Bring High-Speed Inference to the Mainstream」 https://www.cerebras.ai/blog/openai-p... (2026-09-30取得) ・Cerebras「WSE-3 Turbo / The Chip」 https://www.cerebras.ai/chip (2026-09-30取得) ・The Decoder「OpenAI expands Codex and its API at DevDay with security scans, a Decisions API, and Ultrafast」 https://the-decoder.com/openai-expand... (2026-09-30取得) ・ITmedia AI+「ChatGPTに「Ultrafast」、Astraを8倍高速に 利用には「月500ドル」最上位プランが必須」 https://www.itmedia.co.jp/aiplus/arti... (2026-09-30取得) ・価格.com「グラフィックボード・ビデオカード 人気売れ筋ランキング」 https://kakaku.com/pc/videocard/ranki... (2026-09-29取得) みんなが最初に買ったグラボは何だったか、コメントで教えてください。 自分の機械で毎秒何文字出たかも、ぜひ書いていってください。 #ゆっくり解説 #AI #GPT6 #Ultrafast #Cerebras #OpenAI #ローカルLLM #メモリ帯域 #RTX5090 #グラボ #生成AI #AI解説