AI మోడల్ ట్రైనింగ్
-
기스카드 Giskard
LLM 애플리케이션 RAG 및 AI 에이전트를 위한 자동화된 레드팀 테스트, 품질 평가 및 엔터프라이즈급 모니터링 플랫폼
-
구글 AI 스튜디오 AI Studio
Google 공식 Gemini 실험 및 프로토타입 개발 포털
-
아리즈 피닉스 Phoenix
오픈 소스 AI/LLM 관찰 가능한 추적, 평가 및 실험 플랫폼
-
허니하이브 HoneyHive
프로덕션 수준 AI 에이전트를 위한 관찰, 평가, 모니터링 및 지속적인 개선 플랫폼
-
CMMLU CMMLU
다중 영역 지식을 다루고 중국 맥락에서 모델에 대한 지식과 추론을 측정하는 포괄적인 중국 대형 모델 평가 벤치마크
-
구글 코랩 Colab
Google, GPU 가속 기능이 내장된 무료 온라인 Jupyter Notebook 출시
-
DeepEval Confident AI
R&D 프로세스에 평가를 통합하기 위해 Pytest 스타일을 사용하는 LLM 애플리케이션 RAG 및 에이전트를 위한 오픈 소스 평가 프레임워크
-
드림젠 NVIDIA
비디오 세계 모델을 사용하여 합성 훈련 데이터를 생성하는 NVIDIA 로봇 학습 연구 프로젝트
-
플래그 평가 FlagEval
Zhiyuan Research Institute에서 출시한 대형 모델 평가 플랫폼은 다차원적인 모델 능력 평가 및 순위를 제공합니다.








