FlagEval(天秤) – 智源研究院大模型多维度评测平台与开放基准 FlagEval(天秤)是智源研究院推出的大模型综合评测平台,采用“能力-任务-指标”三维框架,提供多模态自动化评测与权威排行榜。 00 AI模型评测# AI基准测试# AI模型评测# BAAI
Open LLM Leaderboard – Hugging Face大语言模型评测排行榜 Open LLM Leaderboard是Hugging Face平台上的大语言模型性能评测排行榜,为用户提供客观、全面的模型能力对比参考。 00 AI模型评测# AI工具导航# AI模型评测# AI评测基准
SearchGPT – OpenAI搜索引擎 SearchGPT是OpenAI推出的AI搜索引擎,通过对话式交互、多模态展示与清晰信源引用,为用户提供快速、准确且可靠的综合答案。 00 AI搜索引擎# AI搜索引擎# AI聊天助手# OpenAI