「成果评估」共找到 1411 篇相关文章
波士顿动力 | 人形机器人Atlas ,最新研究进展!
世界人形机器人运动会引发对自主机器人的讨论。波士顿动力与丰田研究院合作为 Atlas 开发大型行为模型(LBM),使其能自主完成复杂任务,研究团队展示成果并介绍模型构建流程、实践成果及研发原则。
上海交大团队发布首篇「搜索智能体」综述!四个维度深度剖析搜索智能体
上海交大团队发布首篇「搜索智能体」综述,从如何搜索、优化、应用、评估四个维度剖析。随着LLM兴起,搜索从传统模式向搜索智能体转变,虽有潜力但缺统一研究视角与评估框架,该综述提供了路线图。
ICLR 2026 Oral | 西湖大学发布Real PDE Bench
复杂物理系统时空演化预测是核心问题,当前AI模型多在数值仿真数据上训练,难以评估其在真实数据上的表现。西湖大学等实验室提出RealPDEBench,含真实与仿真数据,设三类任务、九个评估指标和十个基线方法。
醒醒吧!CEO猛吹AI写95%代码,绩效考核却还在拼程序员手速?
本文是对 Superhuman 工程负责人 Loic Houssier 的深度访谈。他分享了 AI 时代团队管理、开发流程、绩效评估等方面的变化,指出 AI 虽提升效率,但在质量评估、人才适配等方面仍需探索,还强调观望 AI 发展会有职业风险。
AI 的下一个战场:端侧模型崛起
大模型退烧,小模型接棒。腾讯、阿里等大厂纷纷官宣小模型成果,英伟达、OpenAI 等也有相关动作。端侧模型赛道广阔,但技术含量不低,面壁智能在端侧模型探索上成果丰硕,其 MiniCPM 系列不断迭代,还在多领域落地。
NeurIPS2025 Spotlight | RobustMerge: 多模态大模型高效微调模型合并的全新范式
中科院、中山大学、北大团队针对高效微调模型合并难题,提出「方向鲁棒性」概念,揭示 PEFT 模块合并失败主因,给出 RobustMerge 解决方案,提升性能,成果开源。
澳洲大神用ChatGPT手搓疫苗抢命,救活癌症晚期爱犬!OpenAI总裁爆赞
澳洲AI大牛Paul Conyngham无生物学背景,用ChatGPT+AlphaFold为患癌爱犬设计全球首支定制mRNA疫苗,数周肿瘤缩小50%,引发全网关注,OpenAI总裁等盛赞,或推动人类癌症治疗。
仅限Founder参与:你看到了Clawdbot带来的崭新未来吗?
Cowork、Clawdbot 和 Moltbook 让行业巨变,众多 founder 用 Clawdbot 做出新奇玩意,看到下一代 AI 产品雏形。本周三 Founder Park 举办线上闭门交流,邀一线实践的创业者分享喜悦。
何恺明MIT两名新弟子曝光:首次有女生入组,另一位是FNO发明者,均为华人
AI大牛何恺明主页更新两名新弟子信息,分别是博士生胡珂雅和博士后李宗宜,均为华人。胡珂雅履历亮眼,本科就发表多篇高含金量论文;李宗宜是FNO发明者。何恺明深耕AI for Science,团队阵容豪华。
从游戏少女到AI女神!她用物理驯服AI,让飓风预测快1000倍
本文讲述了AI领域领军人物Rose Yu的成长历程,她从玩游戏起步,到用物理知识改进交通预测、加速飓风模拟,还设想打造“AI科学家”辅助科研,强调AI是助手而非替代者。