なぜ同じAIが機械を替えるだけで8倍速くなるのか|RTX 5090の2万4000倍【ゆっくり解説】
サルでもわかるAIにゅーす速報【ゆっくり解説】
0:00 / 0:00
なぜ同じAIが機械を替えるだけで8倍速くなるのか|RTX 5090の2万4000倍【ゆっくり解説】
827 просмотров · 3 часа назад
サルでもわかるAIにゅーす速報【ゆっくり解説】
7,31 тыс. подписчиков
827 просмотров · 3 часа назад
2026年9月29日のDevDayで、OpenAIが「Ultrafast」という速さの上位プランを出しました。
同じGPT-6 Astraが、Codexで最大8倍・毎秒300トークンまで速くなります。
ところが報道によると、APIの値段のほうもきっちり6倍になります。
中身を賢くしたわけでも、新しいモデルを出したわけでもありません。
重みも学習も何ひとつ変わっていない。変わったのは「動かす機械」のほうです。
この動画では、その機械の正体と、速さと値段がきれいに比例してしまう理由を、
台所の比喩(冷蔵庫・廊下・調理台)で最後まで解きます。
そして最後に、この話をそのまま自分のパソコンへ持ち帰ります。
手元のグラボが毎秒何文字出せるかは、割り算ひとつで先に分かります。
■ この動画で分かること
・「8倍」と「6倍」── 同じ6という数字が、速さと値段の両方に出てくるからくり
・1文字出すたびにモデルの重みを全部読み直しているという、AIの本当の仕組み
・速さを決めているのは計算の力ではなく「メモリ帯域」であること
・Cerebrasのウェハースケール・プロセッサ(オンチップSRAM 44GB / 毎秒43.2ペタバイト)
・なぜ8月は14倍・毎秒750トークンだったのに、今回は8倍・毎秒300トークンに落ちたのか
・値段6倍の意味 ── Fastモード(値段2倍で速さ2.5倍)と並べると何が見えるか
・自分のグラボで毎秒何文字出るかを計算する方法(帯域 ÷ モデルの大きさ)
・VRAMが多いほど速い、は間違い ── パラメータが4倍多いほうが4倍速かった実測
■ 目次
0:00 きょうの話 ── 8倍速くなって、値段も6倍になった
1:43 Ultrafastとは何か ── 同じモデルを速い窓口で動かす券
3:20 値段6倍の中身と、速さが効く仕事
4:55 25倍であって50倍ではない ── プランに仕込まれたわな
6:19 1文字出すたびに、重みを全部読み直している
8:37 速さを決めるのはメモリ帯域 ── 割り算1つで上限が出る
10:41 廊下をなくした机 ── Cerebrasのウェハーと毎秒43.2ペタバイト
13:14 欠陥が出る前提で作る ── 750メガワットの提携
14:56 なぜ8月の14倍が、今回は8倍に落ちたのか
17:01 賢いまま速くする ── 落ちた理由を公式は説明していない
18:53 値段が6倍になる理由 ── Fastと並べて分かること
20:57 家のパソコンの速さを、自分で計算する
22:54 VRAMが多いほど速い、は間違い ── 量子化という手
24:31 RTX 5090の実売と、きょうのまとめ
■ この動画で出てくる主な数字
・GPT-6 Astra Ultrafast … Codexで最大8倍・毎秒300トークン / APIで最大6倍(OpenAI公式)
・APIの値段 … 入力100万トークン60ドル / 出力100万トークン300ドル(標準の6倍。報道)
・Pro 500 … 月500ドル。上限はPlusの25倍(50倍ではない)
・Cerebras WSE-3 Turbo … 面積46,225平方ミリメートル / オンチップSRAM 44GB / 毎秒43.2ペタバイト
・RTX 5090 … 毎秒1,792GB(Cerebrasとの差は約2万4000倍)
・RTX 5060 Ti … 毎秒448GB。10GBのモデルなら毎秒およそ45文字が上限
■ 断っておくこと
・値段が6倍という数字は、OpenAIの価格ページでは確認できていません。独立した2媒体の報道が一致している段階です
・「GPU比15倍」「B300比56倍」はいずれもCerebras自身の主張で、第三者の測定ではありません
・14倍から8倍へ落ちた理由をOpenAIは説明していません。動画で述べた説明は、3つのモデルの実測が階段になっていることからの推論です
・750メガワットの世帯換算は、一般家庭の年間消費電力を4,300kWhとした投稿者の試算です。公式の数字ではありません
この動画は独自に調査した内容をもとに作成しています。図解も独自に作成しています。
■ 引用・出典
・OpenAI「DevDay 2026 Recap」 https://openai.com/index/devday-2026-... (2026-09-30取得)
・OpenAI「Previewing Ultrafast mode: GPT-5.6 Sol at up to 14X the speed」 https://openai.com/index/previewing-u... (2026-09-30取得)
・OpenAI「OpenAI partners with Cerebras」 https://openai.com/index/cerebras-par... (2026-09-30取得)
・Cerebras「OpenAI Partners with Cerebras to Bring High-Speed Inference to the Mainstream」 https://www.cerebras.ai/blog/openai-p... (2026-09-30取得)
・Cerebras「WSE-3 Turbo / The Chip」 https://www.cerebras.ai/chip (2026-09-30取得)
・The Decoder「OpenAI expands Codex and its API at DevDay with security scans, a Decisions API, and Ultrafast」 https://the-decoder.com/openai-expand... (2026-09-30取得)
・ITmedia AI+「ChatGPTに「Ultrafast」、Astraを8倍高速に 利用には「月500ドル」最上位プランが必須」 https://www.itmedia.co.jp/aiplus/arti... (2026-09-30取得)
・価格.com「グラフィックボード・ビデオカード 人気売れ筋ランキング」 https://kakaku.com/pc/videocard/ranki... (2026-09-29取得)
みんなが最初に買ったグラボは何だったか、コメントで教えてください。
自分の機械で毎秒何文字出たかも、ぜひ書いていってください。
#ゆっくり解説 #AI #GPT6 #Ultrafast #Cerebras #OpenAI #ローカルLLM #メモリ帯域 #RTX5090 #グラボ #生成AI #AI解説