OpenCompass官网OpenCompass是由上海人工智能实验室(上海AI实验室)于2023年8月正式推出的大模型开放评测体系,通过完整开源可复现的评测框架,支持大语言模型、多模态模型各类模型的...
- opencompass.org.cn
- 2025-07-14
写作蛙官网写作蛙是由智谱AI推出的免费智能写作工具,可帮助用户快速高效地生成AI原创的高质量内容创意和各种文本任务,如文章、报告、新闻稿、营销文案等。网站服务:写作蛙,AI工具集导航。写作蛙是由智谱A...
白日梦ai视频 文生视频类AIGC创作平台,文生视频、动态画面、AI角色生成、人物/场景一致性,白日梦AI视频官网入口网址。 OpenI AI中文版 DeepSeek R1在线体验,预置超多文案及绘画...
- wenku.baidu.com
- 2025-07-14
通义灵码官网通义灵码是一款基于通义大模型的智能编程辅助工具,提供行级/函数级实时续写、自然语言生成代码、单元测试生成、代码注释生成、代码解释、研发智能问答、异常报错排查等能力,并针对阿里云 SDK/A...
通义智文官网通义智文是阿里云推出的基于通义大模型的免费AI阅读助手,可智能阅读网页、论文、图书和文档,帮助用户在更短的时间内精读文章内容,获取提要和概述,快速掌握要点,提高阅读效率。同时支持提问,可解...
- tongyi.aliyun.com
- 2025-07-15
SuperCLUE官网SuperCLUE 是一个中文通用大模型综合性评测基准,从三个不同的维度评价模型的能力:基础能力、专业能力和中文特性能力。网站服务:SuperCLUE,AI工具集导航。Super...
- cluebenchmarks.com
- 2025-07-15
HELM官网HELM是由斯坦福大学推出的大模型评测体系,该评测方法主要包括场景、适配、指标三个模块,每次评测的运行都需要指定一个场景,一个适配模型的提示,以及一个或多个指标。网站服务:HELM,AI工...
- crfm.stanford.edu
- 2025-07-15
Open LLM Leaderboard官网Open LLM Leaderboard 是最大的大模型和数据集社区 HuggingFace 推出的开源大模型排行榜单,基于 Eleuther AI Lan...
- huggingface.co
- 2025-07-15
MMLU官网MMLU 全称 Massive Multitask Language Understanding,是一种针对大模型的语言理解能力的测评,是目前最著名的大模型语义理解测评之一,由UC Ber...
- paperswithcode.com
- 2025-07-15
LLMEval3官网LLMEval是由复旦大学NLP实验室推出的大模型评测基准,最新的LLMEval-3聚焦于专业知识能力评测,涵盖哲学、经济学、法学、教育学、文学、历史学、理学、工学、农学、医学、军...