chengmoon

帅气的我简直无法用语言描述!
AISEO AI Content Detector – AI内容检测与人性化改写工具

AISEO AI Content Detector – AI内容检测与人性化改写工具

AISEO AI Content Detector是一款集AI内容检测与人性化改写于一体的工具,帮助用户识别并优化AI生成文本,提升内容自然度与原创性。
00
StudyCorgi ChatGPT Detector – 免费AI论文检测工具,识别ChatGPT生成内容

StudyCorgi ChatGPT Detector – 免费AI论文检测工具,识别ChatGPT生成内容

StudyCorgi ChatGPT Detector是一款完全免费的在线AI论文检测工具,通过颜色标记和单词概率分析,快速识别文本是否由ChatGPT生成。
00
GPTZero – 免费AI内容检测工具,精准识别ChatGPT等AI生成文本

GPTZero – 免费AI内容检测工具,精准识别ChatGPT等AI生成文本

GPTZero是一款由普林斯顿大学团队推出的免费AI内容检测工具,通过分析文本复杂度与变化度,帮助用户识别ChatGPT等AI生成内容。
00
朱雀AI检测 – 腾讯推出的AI内容检测助手,精准识别文本图像视频

朱雀AI检测 – 腾讯推出的AI内容检测助手,精准识别文本图像视频

朱雀AI检测是腾讯推出的AI内容检测助手,能精准识别文本、图像、视频是否由AI生成,适用于教育、内容审核等场景。
00
PubMedQA – 生物医学问答数据集与模型评测基准平台

PubMedQA – 生物医学问答数据集与模型评测基准平台

PubMedQA是一个开源的生物医学问答数据集与模型评测基准,用于训练和评估AI模型对医学文献的理解能力。
00
H2O EvalGPT – H2O.ai基于Elo评级的大模型自动评估系统与排行榜

H2O EvalGPT – H2O.ai基于Elo评级的大模型自动评估系统与排行榜

H2O EvalGPT是H2O.ai推出的大模型自动评估平台,基于Elo评级和行业基准提供每周更新的透明排行榜,助力模型选型。
00
LLMEval-3 – 复旦大学NLP实验室专业知识大模型评测基准

LLMEval-3 – 复旦大学NLP实验室专业知识大模型评测基准

LLMEval-3是复旦大学NLP实验室推出的专业知识大模型评测基准,覆盖13大学科门类约20万道题目,用于系统评估模型的垂直领域知识深度。
00
LMArena – 加州大学伯克利分校AI模型匿名对比评估

LMArena – 加州大学伯克利分校AI模型匿名对比评估

LMArena是加州大学伯克利分校推出的AI模型社区评估平台,通过用户匿名投票对比模型回答来生成实时排行榜,推动评估透明化。
00
HELM – 斯坦福大学语言模型整体评估基准与全面评测体系

HELM – 斯坦福大学语言模型整体评估基准与全面评测体系

HELM是斯坦福大学推出的语言模型整体评估基准,通过场景、适配、指标三大模块,系统评估模型在准确率、公平性、毒性等多维度的综合表现。
00
MMBench – 全方位多模态大模型能力评测基准与细粒度评估体系

MMBench – 全方位多模态大模型能力评测基准与细粒度评估体系

MMBench是由顶尖机构联合推出的多模态大模型细粒度评估基准,通过循环评估策略与20项能力维度,全面评测视觉-语言模型性能。
00
CMMLU – 综合性中文大模型评估基准与多学科知识推理测试

CMMLU – 综合性中文大模型评估基准与多学科知识推理测试

CMMLU是专注于评估大模型中文知识与推理能力的综合性基准,涵盖67个学科主题,包含大量中国特定知识题目。
00
OpenCompass – 上海AI实验室大模型开放评测体系与一站式评估平台

OpenCompass – 上海AI实验室大模型开放评测体系与一站式评估平台

OpenCompass是上海AI实验室开源的大模型一站式评测体系,提供评估工具包、基准社区和权威排行榜,推动模型评估标准化
00