AIモデルトレーニング
-
ジェマ Google
Google オープンソースの軽量 LLM、Gemma 2 は 2B/9B/27B を提供、Apache 2.0 は商用利用可能
-
アジェンタ Agenta
オープン ソースの LLMOps プラットフォームは、プロンプト ワードの実験、評価、オンライン、観察をカバーし、50 以上のモデルとエージェント オーケストレーションをサポートします。
-
ジスカルド Giskard
LLM アプリケーション RAG および AI エージェント用の自動化されたレッド チーム テスト、品質評価、エンタープライズ レベルの監視プラットフォーム
-
Google AIスタジオ AI Studio
Google 公式 Gemini 実験およびプロトタイプ開発ポータル
-
アライズフェニックス Phoenix
オープンソースの AI/LLM 観察可能なトレース、評価、実験プラットフォーム
-
ハニーハイブ HoneyHive
実稼働レベルの AI エージェントのための観察、評価、監視、および継続的改善のプラットフォーム
-
カグル Kaggle
Google が所有する世界最大のデータ サイエンス コミュニティおよび ML コンペティション プラットフォーム
-
CMMLU CMMLU
包括的な中国の大規模モデル評価ベンチマーク。マルチドメインの知識をカバーし、中国のコンテキストにおけるモデルの知識と推論を測定します。
-
Googleコラボ Colab
Google、GPUアクセラレーションを内蔵した無料のオンラインJupyter Notebookを発売
-
ディープエヴァル Confident AI
Pytest スタイルを使用して R&D プロセスに評価を組み込む、LLM アプリケーション RAG およびエージェント用のオープンソース評価フレームワーク
-
ドリームジェン NVIDIA
NVIDIA ロボット学習研究プロジェクト ビデオ ワールド モデルを使用して合成トレーニング データを生成
-
フラグ評価 FlagEval
Zhiyuan Research Institute が立ち上げた大規模モデル評価プラットフォームは、多次元モデルの機能評価とランキングを提供します。










