AI评估」共找到 9856 篇相关文章

开源动态8

OpenClaw大考!上海AI Lab InternLM团队WildClawBench 60题,把「龙虾」AI打回原形

上海人工智能实验室InternLM团队推出WildClawBench,含60道高难度任务,在真实OpenClaw环境端到端评测AI Agent。评测涵盖多类别任务,已测14个模型,国产模型表现亮眼,项目开源可复现。

机器之心
新闻资讯8

中国团队首次在Nature子刊发布医疗AI标准,未来医生MedGPT摘得全球桂冠

中国AI医疗公司“未来医生”协同专家制定CSEDB,首次提出评估医疗大模型临床能力的系统性框架,被《npj Digital Medicine》收录。在其评估下,未来医生的MedGPT在主流大模型中夺冠。

量子位
7

AI本该助力新人,为何反而让高手更强?

人们曾认为AI能让初级程序员创造高质量代码,减少对高级工程师依赖。但现实是‘高手 + AI’才是有效组合。文章分析AI优劣,指出其让高手更强,还给出使用建议,强调要校准对AI的期待。

宝玉AI
推荐文章8

当EDA(消息驱动架构)遇到AI Agent:消息驱动在智能体时代的重生

文章探讨消息队列与AI Agent的融合。回顾消息队列发展历程,阐述多智能体协作系统成为AI落地核心架构的原因,分析消息队列与AI Agent的融合点,介绍Apache Pulsar对AI Agent的赋能,还展望了AI与中间件的双向进化。

AI大模型应用实践
新闻资讯7

AI实力榜大洗牌!OpenAI谷歌强势领跑,Anthropic节节败退

Poe最新报告显示,2025年1 - 5月AI各领域市场份额大洗牌。OpenAI和谷歌势头猛,Anthropic掉队。文本生成、推理、图像等各领域竞争激烈,企业需搭建评估体系,按需选模型。

新智元
新闻资讯7

高盛上调腾讯目标价,AI 人才的核心投资选择

高盛上调腾讯目标价,因其业绩强劲且AI推动各业务线增长。腾讯2025年AI应用爆发,投入和专利向好。还提到行业AI人才需求大,腾讯有特别升级的AI产培项目,介绍了投递要求和福利。

特工宇宙
新闻资讯7

港科大教授实测AI眼镜“作弊”:30分钟碾压95%的学生,把传统教学评估体系整破防了

香港科技大学教授团队让搭载ChatGPT - 5.2的乐奇AI眼镜参加《计算机网络原理》期末考,30分钟得92.5分超95%学生。此测试暴露AI眼镜功耗和清晰度问题,也引发对传统教学评估体系的反思。

量子位
开源动态7

Figma凉凉!开源版更好用,社区公认最有颠覆性的「AI原生设计编辑器」

在UI/UX设计领域,Figma曾是绝对统治者,但如今AI设计兴起,其AI功能不佳,开源平替更好。OpenPencil是开源AI原生设计编辑器,被视为最具颠覆性的Figma替代方案,操作与Figma相似,AI功能强大。

开源AI项目落地
新闻资讯7

AI重新打开了创业窗口期?数据告诉你真相

移动互联网红利结束后创业圈寒冬漫长,2025 年起 AI 创业融资回暖,但资金集中于头部公司。AI 使创业成本断崖式下降,一人公司兴起,不过 AI 创业失败率仍高。真正的创业窗口期属于有行业认知、能差异化定位且善用 AI 的人。

AI Reading Hub
新闻资讯7

首位AI女演员出道!好莱坞「天敌」来了,下一代偶像全是代码制造?

9月底苏黎世电影节上,AI制作公司Particle6打造的AI女演员Tilly Norwood亮相引热议。这意味着AI视频生成技术正加速渗透影视行业,也引发了关于AI演员是否会取代人类演员等诸多争议。

新智元