Перейти к содержимому

【ゆっくり解説】AIはなぜ、会話が長くなると忘れるのか|100万トークン読めるのに最初の頼みが消える理由

AIゆっくり探究所

0:00 / 0:00

【ゆっくり解説】AIはなぜ、会話が長くなると忘れるのか|100万トークン読めるのに最初の頼みが消える理由

13 114 просмотров · 2 дн. назад
AIゆっくり探究所
623 подписчика
13 114 просмотров · 2 дн. назад
AIと長く話していると、最初に「敬語はやめて、タメ口で」と頼んだのに、いつのまにか敬語に戻っている。決めたはずの主人公の名前まで変わっている。100万トークン読めると宣伝されているのに、なぜでしょうか。この動画はその理由を、論文と開発元の原文で確かめます。 答えの出発点は、AIは会話を何も覚えていない、ということです。返事を書くたびに、会話の全文(と見えないシステムの指示)を頭から読み直しています。それでも見落とすのは、注意(アテンション)が全部の語に「合計1」を配る仕組みだからです。長くなるほど1語あたりの取り分は薄まり、資料の真ん中は見落とされやすくなります(Uの字)。 位置の数え方(RoPE と、その引き延ばし)、学習した長さの外が苦手な理由、針の試験(Needle in a Haystack)の落とし穴と言葉が一致しない針(NoLiMa)、会話の途中で指示がずれる研究、小出しに頼むと平均39%落ちる研究、KVキャッシュの重さ(1語あたり約320KB)、昔のAI(RNN・LSTM)の忘れ方と Mamba との取り引き、そして ChatGPT の「記憶」の正体までを扱います。最後に、長い会話との付き合い方を4つまとめます。 ■ 主な出典 ・Liu ほか「Lost in the Middle」(2023) https://arxiv.org/abs/2307.03172 / Salvatore ほか (2025) https://arxiv.org/abs/2510.10276 ・Vaswani ほか「Attention Is All You Need」(2017) https://arxiv.org/abs/1706.03762 ・Xiao ほか「Attention Sinks」(2023) https://arxiv.org/abs/2309.17453 / Miller「Attention Is Off By One」 https://www.evanmiller.org/attention-... ・Nakanishi「Scalable-Softmax」(2025) https://arxiv.org/abs/2501.19399 / Qiu ほか「Gated Attention」(2025) https://arxiv.org/abs/2505.06708 ・Su ほか「RoFormer(RoPE)」(2021) https://arxiv.org/abs/2104.09864 / Press ほか「ALiBi」(2021) https://arxiv.org/abs/2108.12409 ・Chen ほか「Position Interpolation」(2023) https://arxiv.org/abs/2306.15595 / Peng ほか「YaRN」(2023) https://arxiv.org/abs/2309.00071 ・Anil ほか (2022) https://arxiv.org/abs/2207.04901 / An ほか「STRING」(2024) https://arxiv.org/abs/2410.18745 ・Llama 3 技術報告 (2024) https://arxiv.org/abs/2407.21783 / 設定 https://huggingface.co/NousResearch/M... ・Kamradt「Needle In A Haystack」 https://github.com/gkamradt/LLMTest_N... / Gemini 1.5 (2024) https://arxiv.org/abs/2403.05530 ・Hsieh ほか「RULER」(2024) https://arxiv.org/abs/2404.06654 / Modarressi ほか「NoLiMa」(2025) https://arxiv.org/abs/2502.05167 ・Chroma「Context Rot」(2025) https://research.trychroma.com/contex... ・Li ほか (2024) https://arxiv.org/abs/2402.10962 / Dongre ほか (2025) https://arxiv.org/abs/2510.07777 ・Laban ほか「LLMs Get Lost In Multi-Turn Conversation」(2025) https://arxiv.org/abs/2505.06120 / Liu ほか (2026) https://arxiv.org/abs/2602.07338 ・Dao ほか「FlashAttention」(2022) https://arxiv.org/abs/2205.14135 / Ainslie ほか「GQA」(2023) https://arxiv.org/abs/2305.13245 / Hugging Face「KV Cache」 https://huggingface.co/blog/kv-cache ・Bahdanau ほか (2014) https://arxiv.org/abs/1409.0473 / Sutskever ほか (2014) https://arxiv.org/abs/1409.3215 ・Wikipedia「Vanishing gradient problem」「Long short-term memory」「Serial-position effect」「Attention economy」 ・Gu・Dao「Mamba」(2023) https://arxiv.org/abs/2312.00752 / Jelassi ほか「Repeat After Me」(2024) https://arxiv.org/abs/2402.01032 ・OpenAI「Conversation state」 https://platform.openai.com/docs/guid... /「Prompt caching」 https://platform.openai.com/docs/guid... ・OpenAI「Memory FAQ」 https://help.openai.com/en/articles/8... / Rehberger (2025) https://embracethered.com/blog/posts/... ・Anthropic「Context windows」 https://docs.claude.com/en/docs/build... /「Long context tips」 https://docs.claude.com/en/docs/build... ・Anthropic「Effective context engineering」 https://www.anthropic.com/engineering... /「Prompt caching」 https://docs.claude.com/en/docs/build... ■ 注意 チャット画面・代筆屋・付箋・机と明かり・箱などの絵は、仕組みを説明するためのたとえや模式図です。グラフの線や棒の形は模式で、数字はそれぞれの論文・資料の条件でのものです。どのAIサービスでも同じになるとは限りません。 ■ 章 0:00 はじめに(タメ口の頼みと消えた名前) 2:18 第1章 AIは何も覚えていない 5:59 第2章 答えを渡したのに下がった 8:38 第3章 付箋は1枚しかない 11:38 第4章 長いほど薄まる 14:47 第5章 最初の語に溜まる注意 18:44 第6章 番地を書く時計の針 23:07 第7章 長い文を読んだ経験が少ない 25:27 第8章 針の試験の落とし穴 31:01 第9章 会話で指示がずれる 34:32 第10章 窓を無限にできない理由 36:52 第11章 昔のAIは逆に忘れた 40:23 第12章 記憶機能の正体と使い方 ─── 音声合成: AquesTalk (株式会社アクエスト) https://www.a-quest.com/ BGM: OpenTracks(旧DOVA-SYNDROME)「プラネタリウムガーデン」「さみしいおばけと東京の月」「YOIYAMI-宵闇-」「Serene」「Fireworks」 この動画は東方Projectの二次創作です。