AIモデルトレーニング
-
アライズフェニックス Phoenix
オープンソースの AI/LLM 観察可能なトレース、評価、実験プラットフォーム
-
CMMLU CMMLU
包括的な中国の大規模モデル評価ベンチマーク。マルチドメインの知識をカバーし、中国のコンテキストにおけるモデルの知識と推論を測定します。
-
Googleコラボ Colab
Google、GPUアクセラレーションを内蔵した無料のオンラインJupyter Notebookを発売
-
ディープエヴァル Confident AI
Pytest スタイルを使用して R&D プロセスに評価を組み込む、LLM アプリケーション RAG およびエージェント用のオープンソース評価フレームワーク
-
ドリームジェン NVIDIA
NVIDIA ロボット学習研究プロジェクト ビデオ ワールド モデルを使用して合成トレーニング データを生成
-
フラグ評価 FlagEval
Zhiyuan Research Institute が立ち上げた大規模モデル評価プラットフォームは、多次元モデルの機能評価とランキングを提供します。





