SANTISMM Labs

ラボ

AI、エージェント、ロボティクス、教育、生産性、複雑なシステムを探求するための、実験、ベンチマーク、シミュレーター、インタラクティブツール。

すべてのスポーツ・アトラス
ベンチマークシミュレーター計算ツールコンバーター教育ゲーム実験

ベンチマーク

ベンチマークSnapshot · Jun 2026
AIエージェント・ベンチマーク

AIエージェント・ベンチマークの飽和トラッカー:測定対象、SOTA、ヘッドルーム(伸び代)、人間とのギャップ、および研究の優先度。

ベンチマーク
世界の各試験はどれほど難しいのか?

18の大学入学試験(PAES、PAU、IB、SAT、高考、修能、JEEなど)の学術的な難易度を7つの次元で比較するインタラクティブなベンチマーク。世界地図、レーダーチャート、ランキングを備えています。

ベンチマーク
PAES vs PAU vs IB

チリのPAES、スペインのPAU、およびIBディプロマの学術的な難易度を、6つの認知次元と8つの科目で比較するインタラクティブなベンチマーク。レーダーチャートを備えています。

シミュレーター

シミュレーターv1.0 · Aug 2026
エージェンティック・コントロール・サンドボックス

インタラクティブなサンドボックス:6つの軸でエージェントを構成し、OWASP LLM Top 10の脅威を選択し、エージェンティック・コントロール・マトリクスの18のコントロールのオン/オフを切り替えて、カバレッジ(埋められた象限、空のままの象限、対応するフレームワーク)を確認できます。残存リスクスコアは意図的に排除されています。

計算ツール

計算ツールv1.0 · Aug 2026
AIエージェントの真の経済学

ワークロード量、トークン価格、ツール、再試行、人間のレビュー、手戻りから、月間の運用コスト、正しい成果あたりのコスト、削減額、ROI、損益分岐点を推定します。

計算ツールv1.0 · Aug 2026
評価はいくつ必要か?

選択した信頼水準で少なくとも1つの失敗を検出し、明示的な許容誤差でその発生頻度を推定するために必要なケース数を計算します。

計算ツールv1.0 · Aug 2026
人間による監視キャパシティ

AIシステムを本番環境に導入する前に、レビュー時間、エスカレーション、FTE、コスト、持続可能な処理量、バックログの規模を見積もります。

コンバーター

コンバーターv1.0 · Aug 2026
ユースケース → エージェンティック・ベクトル

システムを6つの行動軸とアクションサーフェスにわたって分類し、そのガバナンス・リスク帯を推定し、コントロールシグナルを表面化させ、マッピングされた24のエージェントの中から最も近いネイバーを見つけます。

コンバーターv1.0 · Aug 2026
コントロール&フレームワーク・トランスレーター

エージェンティック・コントロール・マトリクスの18のコントロールを、EU AI法、ISO 42001, NIST AI RMF、OWASP LLM Top 10、MITRE ATLASに対応付けます(ただし、マッピングはコンプライアンスと同義ではないという明示的な警告付き)。

コンバーターv1.0 · Aug 2026
人間の言葉で表すLLMコンテキスト

トークンを、単語数、ページ数、ドキュメント数、読書・発話時間(分)、コンテキストウィンドウの使用率、および概算の入力コストに変換します。

教育ゲーム

教育ゲームv1.0 · Aug 2026
ギャップを埋める

5ラウンドの教育ゲーム:限られた予算内で適切なガバナンスコントロールを選択し、各エージェントの重要なギャップを埋め、即座に表示される解説から学びます。

教育ゲームv1.0 · Aug 2026
モデル、エージェント、それともハーネス?

基本機能、目標を追求する主体、そしてコンテキスト、メモリ、ツール、コントロールを接続するインフラストラクチャを区別するための12のケース。

教育ゲームv1.0 · Aug 2026
ベンチマーク・ディテクティブ

AIの主張を調査し、実際にそれらをテストする証拠を選択し、飽和、汚染、不確実性、誤解を招く指標を見つけ出します。

教育ゲームv1.0 · Aug 2026
世界の試験チャレンジ

18の大学入学制度に関する12ラウンドのゲーム:難易度を比較し、国を特定し、認知プロファイルを選抜圧力から切り離します。

実験

実験v1.0 · Aug 2026
ホメロス・アトラス

『イリアス』と『オデュッセイア』のエピソードが起こった可能性のある場所を示す確率論的マップ。各場所は「合意」、「妥当」、「推測」、「神話」に分類され、公開された評価基準に照らして0〜12点で評価されています。ソース、対立する説、再利用可能なJSON/GeoJSONも含まれています。

実験v1.1 · Aug 2026
自律型エージェントのタキソノミー

OpenAI、Anthropic、Google、Microsoft、Amazon、SpaceXAIからオープンソースの最前線に至る24のAIエージェントを、6つの直交する軸とアクションサーフェスにわたるベクトルとしてエンコードするインタラクティブなタキソノミー。フィルター可能なテーブル、A×T×Iガバナンス・リスク・マトリクス、機械読み取り可能なJSON APIを備えています。

実験Jun 2026
AIに最もさらされている職業

22の職業グループのインタラクティブなマップ。AIの理論的な能力と、実際の現実世界での利用状況(2026年6月時点)を比較し、カテゴリランキング、最も影響を受ける職業、およびマクロ数値を厳格な情報源に基づいて提供します。

実験Mundial 2026
マネー・ワールドカップ

2026年ワールドカップにおいて、どの代表チームがその市場価値以上の成果を上げているか。チームごとの勝ち点対ユーロ価値を示す、ライブの効率性インデックス。

実験Atlas
ワールド・サーフ・アトラス

100以上の世界クラスの波を収録したインタラクティブなアトラス。波の方向(レフト/ライト/両方)、ブレイクのタイプ、レベル、月ごとの平均的な波の高さが世界地図上にプロットされています。

実験Atlas
ワールド・スキー・アトラス

世界地図上の130以上のスキーリゾート。滑走可能距離(km)、難易度別のコース、雪質、月間降雪量、気温、日照時間、さらにリフト券の価格を表示します。

実験Atlas
ワールド・バイク・パーク・アトラス

世界各地の40以上のリフト付きMTB/e-bikeパーク。難易度別のトレイル、標高差、距離(km)、シーズン期間、1日券の価格を世界地図上に表示します。