汎用チャット・アシスタント

ツリー全体2 票

汎用チャット・汎用エージェント・汎用アシスタントへの投票の総合評価です。

ChatGPT や Claude、Gemini など、文章生成・要約・雑談・調べ物まで幅広くこなす汎用対話 AI の比較です。「まず 1 本だけ契約するなら」を軸に、応答の自然さ・得意分野・料金プランを投票で比較できます。

小カテゴリー投票は各小カテゴリーのページから

A良い
B普通
Cやや問題あり
ほぼ不可能
評価基準

tier はあくまで投票者個人の主観的な評価で大丈夫です。以下は投票時の目安です。

  • S

    おすすめストレスなくタスクを実行可能。少ないプロンプト・ラリーで意図したモノを生成できる。コストパフォーマンスに優れる。ハルシネーションがほとんどない。

  • A

    良い熟練者であればほとんどのタスクを実行可能。最終的に意図したモノを生成できる。コストパフォーマンスは良い。ハルシネーションが少ない。

  • B

    普通多くのプロンプト・ラリーによって意図したモノを生成できる。コストパフォーマンスは普通。エラーやハルシネーションが起きる。

  • C

    やや問題ありどんなにラリーを重ねても意図したモノを生成できない可能性がやや高い。エラーやハルシネーションが多い。

  • ほぼ不可能ほとんどの場合で意図したモノを生成できない。

投票は小カテゴリーから

この tier 表は小カテゴリーへの投票の集計です。投票したい小カテゴリーを選んでください。

Arena ベンチマークと比べる

arena.ai (旧 LMArena)のブラインド対戦 Elo を tier に換算した参考値です arena.ai データ: LMArena Leaderboard Dataset (CC BY 4.0)

この tier 表の読み方 (Arena とは?)

Arena (旧 LMArena)は、2 つの AI の回答を名前を伏せて見比べて良い方を選ぶ投票サイトです。世界中の投票がチェスと同じ Elo レーティングに集計されます。

トップとの Elo 差で tier にしています: 20 以内 = S、35 以内 = A、60 以内 = B、それより下 = C。

サービス表示では、同じサービスのモデルのうち最高スコアのものを代表にしています。

テキスト対話2026-08-21 時点 上位 25 件を表示 (全 394 モデル)

みんなの投票とのズレ

共通 3 サービス中、tier 一致 1・±1 段以内 2

  • Gemini投票 C/Arena Sみんなの投票が 3 段下
  • ChatGPT投票 S/Arena Aみんなの投票が 1 段上
  • Claude投票 S/Arena S一致

Arena には載っているが、まだ投票が集まっていない: Meta AI / Qwen Chat / Z.ai / Kimi / ERNIE Bot (文心一言)

テキスト対話 (日本語)2026-08-21 時点 上位 25 件を表示 (全 257 モデル)

みんなの投票とのズレ

共通 3 サービス中、tier 一致 2・±1 段以内 2

  • Gemini投票 C/Arena Sみんなの投票が 3 段下
  • ChatGPT投票 S/Arena S一致
  • Claude投票 S/Arena S一致

Arena には載っているが、まだ投票が集まっていない: Qwen Chat / Kimi / Z.ai / DeepSeek

コメント