Перейти к содержимому

【速報】TypeSafeAI Jev登場 LLMじゃない新しい最先端AI

AI時短ラボ

0:00 / 0:00

【速報】TypeSafeAI Jev登場 LLMじゃない新しい最先端AI

12 522 просмотра · 11 часов назад
AI時短ラボ
7,05 тыс. подписчиков
12 522 просмотра · 11 часов назад
TypeSafe AIが2026年9月15日に発表した新モデル「Jev」を、公式ブログと評価サイトの原文から解説します。ChatGPTやClaudeのように文章を書くのではなく、最初に決めた判定の結果だけを、確かさの数字つきで返すAIです。速さ・値段・答えの形が崩れない仕組みと、発表の弱い所まで、数字はすべて出典つきで並べています。 ■ チャプター 0:00 オープニング 0:13 何が違うのか 2:44 誰が作ったのか 4:02 速さと値段 6:18 答えの形が壊れない、の意味 8:19 何に使うのか 10:17 この発表の弱い所 11:42 まとめ ■ 一次ソース ・TypeSafe AI 公式ブログ「Introducing System One Models & Jev」(2026-09-15) https://typesafe.ai/blog/introducing-... ・評価サイト(4種類の業務・正解率/コスト/時間の生データ) https://evals.typesafe.ai/ ・ドキュメント https://docs.typesafe.ai/ ・System One LLM wrapper(他社LLMを同じ形式で評価するための公開コード) https://github.com/typesafe-ai/system... ■ 但し書き ・動画内の数字はすべてTypeSafe AI自身の評価(evals.typesafe.ai・2026-09-16取得)です。第三者による検証はまだ出ていません。 ・評価の「正解」はGPT-6 AstraとClaude Fable 5.1(両方high thinking)の答えの平均です。この2モデル自身は評価対象に含まれていません。 ・「値段76分の1・速さ25倍」はGPT-5.6 Terra(workflow方式・正解率67.9%)との比較を当方で計算した値です($0.0304÷$0.0004=76、10.1秒÷0.4秒=25)。TypeSafeトップページの「193.6倍速・444.6倍安い」は同社の表記で、同社自身が「良く出た方の数字」と注記しています。 ・「答えの形の誤り0%」は実測ではなく、答えの形が事前に固定されているため同社が0を置いた仕様上の値です。判定の中身の誤りは残ります。 ・ChatGPT/Claude側のエラー率はOpenRouter経由の集計で、難しい依頼ほど高性能モデルに回る偏りがあり得ると同社が明記しています。 ・価格「入力100万トークン$0.042・出力無料」は発表時点の表記です。日本円換算(約6円)は1ドル150円での概算です。 ・動画内の「苦情メールの仕分け」「90と出したら9割当たる」は仕組みを説明するための仮の例で、同社の実データではありません。 ・Jevは現時点で早期アクセスのみ(順番待ち登録した開発者から順次)。一般提供の時期は未発表です。 ・Jevの内部構造(アーキテクチャ)は非公開で、「LLMではない」という同社の記述以上のことは分かっていません。 ■ クレジット ナレーション: VOICEVOX:ずんだもん / VOICEVOX:四国めたん BGM: 魔王魂 https://maou.audio/ 図表: TypeSafe AI blog / evals.typesafe.ai(引用・出典は画面内に表示) サイト: https://www.ai-jitan-hub.com ■ お仕事のご依頼 タイアップ・案件のご相談: aijitanlab0@gmail.com (For business inquiries: aijitanlab0@gmail.com)