AI Orchestration Platform / Crucible Engine

世界最高性能を狙う、 世界最高性能を 狙う、 田中さん。

TanakaSun Proは、複数の世界最高峰AIの知見を突き合わせ、 検証を重ねて一つの答えへ磨き上げるAIオーケストレーションです。 中核エンジンCrucibleが、単体の頭脳では届きにくい精度を引き出します。

GPQA Diamond Benchmark
96.0%

GPQA Diamondは、物理・化学・生物の博士レベル問題で構成される科学推論ベンチマークです。 2026年6月24日現在、TanakaSun Proは同ベンチマークで96.0%を記録し、世界最高スコアを示しています。

Crucible

一つのAIに頼らない。複数の知性を統合する。

Crucibleは、単体モデルの回答をそのまま採用する仕組みではありません。 複数AIの推論を独立に走らせ、根拠を照合し、矛盾や弱い仮定を取り除いたうえで、 検証を通過した一つの結論へ統合します。

01

独立回答

同じ問いに対して各AIが個別に推論し、結論と根拠を提示します。最初から一つの答えに寄せません。

02

相互検証

回答同士を照合し、矛盾、根拠不足、論点の抜けを検出します。弱い主張はここで落とします。

03

統合回答

残った根拠を再構成し、業務で使える一つの回答として出力します。単なる要約ではなく、検証後の結論です。

ベンチマーク評価を見る

Evidence

実績は、数字で確認できる。

GPQA Diamondの結果は、単独の数値だけでなく、評価対象、参照リーダーボード、 モデル別比較表とあわせて確認できる形で整理しています。 現在はGPQA Diamondの計測済み結果を掲載し、他の代表的ベンチマークも同じ形式で順次追加します。

計測済みスコア 96.0%

GPQA Diamond / 198問

評価範囲 博士レベル科学QA

物理・化学・生物を中心とする高難度の科学推論

確認導線 モデル別スコア一覧

公式ベンチマークリンクと比較表をベンチマークページに掲載

ベンチマーク評価を見る

ベンチマークページでは、GPQA Diamondのモデル別スコア一覧、各ベンチマークの本家リンク、 評価方法、実行ログ、追試APIの公開予定を確認できます。参照: Epoch AI GPQA DiamondVals AI GPQA DiamondArtificial Analysis系GPQAデータ。 TanakaSun Proの値は2026年6月24日のGPQA実行ログに基づきます。

Service Lineup

Playground、API、カスタマイズAI。

TanakaSun Proは、まずチャット型Playgroundとして提供します。 その上に、Crucibleを外部システムから呼び出すAPI、さらに企業や業務ごとの判断業務に合わせたカスタマイズAIエンジンを展開します。

01 / Available

TanakaSun Playground

通常のチャット画面で使えるAIプレイグラウンドです。ユーザーはモデルを選ばず、Autoが問いの難度に応じて応答の深さを切り替えます。

  • 軽い質問は高速に、深い調査や設計判断はProへ自動切替
  • 複数視点の比較や重大な意思決定では、より深い検証へ拡張
  • 画像・ファイル添付、GitHub文脈読み込み、回答下の実行メタ表示に対応
  • プロジェクトにメンバーを招待し、人間複数人とAIで同じ議論を共有
今すぐ試す
02 / Preparing

Crucible API

複数AIの回答生成、検証、統合を一つのAPIエンドポイントから扱えるようにします。 アプリケーション側は個別のAIを選び分けるのではなく、問いを投げ、検証済みの最終回答を受け取ります。

  • 1つのリクエストで、複数AIの知見を統合した回答を取得
  • 長時間処理はジョブとして管理し、実行状態と最終回答を取得
  • 用途に応じてSynthesis型とDiscussion型の処理を使い分け
  • 評価方法、実行ログ、追試APIはベンチマークページで順次公開
今すぐ試す
03 / Custom

カスタマイズAIエンジン

TanakaSun Proを基盤に、企業・業務ごとのデータ、評価軸、業務フローに合わせたカスタマイズAIへ育てます。 汎用チャットではなく、特定業務の判断補助に最適化したAIエンジンです。

  • 人事領域: 評価、配置、育成、面談準備を支援するHR評価AI
  • 事業調査領域: 市場調査、仮説検証、リスク整理を支援
  • 出版・メディア領域: 企画、事実確認、論点整理、専門調査を支援
  • 各社の判断基準と監査可能な根拠提示を組み込む
カスタマイズAIについて相談する

Models

田中さんのモデルの種類。

現在提供する主力モデルはTanakaSun Proです。TanakaSun Maxは、より重い検証を必要とする業務向けの上位モデルとして準備中です。

提供中

TanakaSun Pro

96.0%

現在提供中のTanakaSun Proが、GPQA Diamondで96.0%を記録したモデルです。 調査、文章作成、要約、コード相談、判断補助に使える標準のProモデルです。

バージョン
  • TanakaSun Pro - Saitama Ver.
  • TanakaSun Pro - Grill Ver.
今すぐ試す
準備中

TanakaSun Max

準備中

TanakaSun Proよりも重い検証、長い文脈、専門性の高い判断補助を想定した上位構成です。 現時点では公開準備中のため、提供開始時期と仕様は確定後に案内します。

提供開始前

TanakaSun Pro & Max

田中さんが舞う

現在提供中のTanakaSun Proから、次段階のTanakaSun Maxへ。 Crucibleは問いに応じて複数の知性を束ね、検証し、業務で使える一つの答えへ導きます。

優雅に舞う田中さんのイラスト

田中さんの回答は必ずしも正しいとは限りません。重要な情報は確認してください。