登录 注册 退出
博客 AI资讯+
热门搜索: 2024 坍塌之后

标签:大模型评测

共 8 篇文章
院士团队联手给医疗大模型立了把尺子:MedBench 5.0正式发布 AI

院士团队联手给医疗大模型立了把尺子:MedBench 5.0正式发布

7月31日,上海人工智能实验室联合钟南山、葛均波院士团队发布MedBench 5.0医疗AI评测体系。新版本首创医疗原子技能评测范式,将临床任务拆解为五大能力维......

普思AI资讯 3星期前 8 阅读
Claude Opus 5深度评测:半价追平Fable 5,Anthropic这波把旗舰定价逻辑打穿了 AI

Claude Opus 5深度评测:半价追平Fable 5,Anthropic这波把旗舰定价逻辑打穿了

7月25日Anthropic发布Claude Opus 5,定价与Opus 4.8持平(5/25美元),性能对标Fable 5,价格仅一半。Frontier-B......

普思AI资讯 3星期前 35 阅读
Gemini 3.6 Flash评测:Token省了17%,智能指数原地踏步,用户为什么不买账? AI

Gemini 3.6 Flash评测:Token省了17%,智能指数原地踏步,用户为什么不买账?

7月21日谷歌发布Gemini 3.6 Flash,输出Token减少17%、价格降至7.5美元/百万Token,DeepSWE等基准测试有提升。但Artifi......

普思AI资讯 3星期前 7 阅读