WHITE PAPER · 2026.10.01
判断特化モデル(Jevほか)の日本語実力ランキング
本家と公開モデル 10 個を、同じ 15 問で測った
世の中の AI の順位表は英語の問題で作られています。TypeSafe AI の本家 Jev と、それをまねた無料の公開モデル 10 個に日本語の同じ 15 問を解かせ、順位・2 つの失敗・自前か本家か・自社で確かめる手順を、経営の判断材料としてまとめました。
目次
- 1先に結論。英語の順位表は、日本語で崩れた
- 2同じ 15 問を、同じ聞き方で、1 回だけ
- 3本家に並んだ無料モデルは、10 個のうち 1 つ
- 4英語の 2 位が、日本語では 9 位に落ちた
- 5失敗は 2 種類。痛みも 2 種類
- 6何も止めない AI ほど、危ない投稿を静かに通す
- 7安全な告知を止めた原因は、ほぼ一つの読み違い
- 8問題を増やすと、上位 4 つの差は消えた
- 9自前で持つか、本家に払うか
- 10順位表より安い保険 — 自社で確かめる 12 の手順
- 11この順位を、どこまで信じてよいか
PDF を受け取る
フォームにご入力いただくと、ダウンロードのリンクをメールでお送りします。
任意
AI の開発・提供をしている事業者からのお申し込みはお受けしていません。お申し込みの確認のため、入力内容を米国の TypeSafe AI 社へ送って判定します(プライバシーポリシー・利用規約)。