AIモデルトレーニング
-
H2O EvalGPT EvalGPT
H2O.aiが開始したElo評価法に基づく大規模モデル評価システム
-
アライズフェニックス Phoenix
オープンソースの AI/LLM 観察可能なトレース、評価、実験プラットフォーム
-
CMMLU CMMLU
包括的な中国の大規模モデル評価ベンチマーク。マルチドメインの知識をカバーし、中国のコンテキストにおけるモデルの知識と推論を測定します。
-
Googleコラボ Colab
Google、GPUアクセラレーションを内蔵した無料のオンラインJupyter Notebookを発売
-
ディープエヴァル Confident AI
Pytest スタイルを使用して R&D プロセスに評価を組み込む、LLM アプリケーション RAG およびエージェント用のオープンソース評価フレームワーク
-
ドリームジェン NVIDIA
NVIDIA ロボット学習研究プロジェクト ビデオ ワールド モデルを使用して合成トレーニング データを生成
-
フラグ評価 FlagEval
Zhiyuan Research Institute が立ち上げた大規模モデル評価プラットフォームは、多次元モデルの機能評価とランキングを提供します。
-
無料の大規模モデル API プラットフォーム ガイド (無料トークン API の概要) AI工具集
国内外の無料大規模モデルAPIプラットフォーム集約ガイド
-
絶対零度 LeapLabTHU
清華大学やその他の機関が提案したゼロデータ推論トレーニング パラダイム。モデルは独自に質問を生成して解決し、推論を強化します。
-
Gdpval OpenAI
OpenAI は、44 の職業における 1,320 の実際のタスクを通じて AI の経済価値を測定する、オープンソースの AI モデル経済価値評価フレームワークです。
-
ジェマ3 Google DeepMind
Gemma 3 は、AI 開発者および研究者向けのモデル トレーニング プラットフォームで、モデルの微調整、トレーニング管理、展開をサポートします。
-
エーテル Aether
4D 再構成、ビデオ予測、ビジュアル プランニングを統合するオープンソースの世界モデル研究フレームワーク。











