Entraînement de modèle IA
-
Arize Phoenix Phoenix
Plateforme open source de traçage, d'évaluation et d'expérimentation observable AI/LLM
-
CMMLU CMMLU
Benchmark complet d'évaluation des grands modèles chinois, couvrant les connaissances multi-domaines, mesurant la connaissance et le raisonnement du modèle dans le contexte chinois
-
Google Colab Colab
Google lance Jupyter Notebook en ligne gratuit avec accélération GPU intégrée
-
Évaluation profonde Confident AI
Cadre d'évaluation open source pour l'application LLM RAG et Agent, utilisant le style Pytest pour intégrer l'évaluation dans le processus de R&D
-
RêveGen NVIDIA
Projet de recherche NVIDIA Robot Learning utilisant des modèles du monde vidéo pour générer des données de formation synthétiques
-
FlagEval FlagEval
La plateforme d'évaluation de grands modèles lancée par l'Institut de recherche Zhiyuan fournit une évaluation et un classement des capacités des modèles multidimensionnels.





