AIモデルトレーニング
-
ガリレオ Galileo
GenAI、RAG、エージェント向けの評価、可観測性、実稼働ガードレール プラットフォーム
-
ジェマ Google
Google オープンソースの軽量 LLM、Gemma 2 は 2B/9B/27B を提供、Apache 2.0 は商用利用可能
-
エース・エゴ ACE-Ego
一つの頭脳、複数種類の身体化操作VLAモデル研究プロジェクト
-
アジェンタ Agenta
オープン ソースの LLMOps プラットフォームは、プロンプト ワードの実験、評価、オンライン、観察をカバーし、50 以上のモデルとエージェント オーケストレーションをサポートします。
-
ジスカルド Giskard
LLM アプリケーション RAG および AI エージェント用の自動化されたレッド チーム テスト、品質評価、エンタープライズ レベルの監視プラットフォーム
-
Google AIスタジオ AI Studio
Google 公式 Gemini 実験およびプロトタイプ開発ポータル
-
ハニーハイブ HoneyHive
実稼働レベルの AI エージェントのための観察、評価、監視、および継続的改善のプラットフォーム
-
アライズフェニックス Phoenix
オープンソースの AI/LLM 観察可能なトレース、評価、実験プラットフォーム
-
CMMLU CMMLU
包括的な中国の大規模モデル評価ベンチマーク。マルチドメインの知識をカバーし、中国のコンテキストにおけるモデルの知識と推論を測定します。
-
カグル Kaggle
Google が所有する世界最大のデータ サイエンス コミュニティおよび ML コンペティション プラットフォーム
-
Googleコラボ Colab
Google、GPUアクセラレーションを内蔵した無料のオンラインJupyter Notebookを発売
-
ディープエヴァル Confident AI
Pytest スタイルを使用して R&D プロセスに評価を組み込む、LLM アプリケーション RAG およびエージェント用のオープンソース評価フレームワーク










