SendSignal β
Read in English

WHITE PAPER · 2026.10.01

判断特化モデル(Jevほか)の日本語実力ランキング

本家と公開モデル 10 個を、同じ 15 問で測った

世の中の AI の順位表は英語の問題で作られています。TypeSafe AI の本家 Jev と、それをまねた無料の公開モデル 10 個に日本語の同じ 15 問を解かせ、順位・2 つの失敗・自前か本家か・自社で確かめる手順を、経営の判断材料としてまとめました。

目次

  1. 1先に結論。英語の順位表は、日本語で崩れた
  2. 2同じ 15 問を、同じ聞き方で、1 回だけ
  3. 3本家に並んだ無料モデルは、10 個のうち 1 つ
  4. 4英語の 2 位が、日本語では 9 位に落ちた
  5. 5失敗は 2 種類。痛みも 2 種類
  6. 6何も止めない AI ほど、危ない投稿を静かに通す
  7. 7安全な告知を止めた原因は、ほぼ一つの読み違い
  8. 8問題を増やすと、上位 4 つの差は消えた
  9. 9自前で持つか、本家に払うか
  10. 10順位表より安い保険 — 自社で確かめる 12 の手順
  11. 11この順位を、どこまで信じてよいか

PDF を受け取る

フォームにご入力いただくと、ダウンロードのリンクをメールでお送りします。

任意

AI の開発・提供をしている事業者からのお申し込みはお受けしていません。お申し込みの確認のため、入力内容を米国の TypeSafe AI 社へ送って判定します(プライバシーポリシー・利用規約)。