「AI评测」共找到 10087 篇相关文章

算法论文8

三维空间太难懂?RoboTracer让机器人理解复杂空间指令,推理3D空间轨迹,开放世界也能精确行动

家庭环境复杂,让机器人理解空间指令难,现有VLM多聚焦2D推理。北航、北大等联合推出多模态大模型RoboTracer,能精准生成3D轨迹,在多项评测中领先,还能直接集成到机器人,完成复杂任务。

机器之心
新闻资讯8

OpenAI官宣:重组完成!非营利基金会手握1300亿美金股权,专注两大领域

OpenAI董事会主席Bret Taylor宣布公司完成资本重组,非营利的OpenAI基金会手握约1300亿美元股权,控制营利性业务。基金会初期250亿美元聚焦健康与疾病治疗、AI韧性技术方案。今晚Sam将直播答疑。

AI寒武纪
新闻资讯7

万象入模 风起琶洲 | 甲子光年

9月23日下午,「第四届琶洲算法大赛大模型前沿技术分论坛暨琶洲模方孵化项目展示」将在广州琶洲举行。届时,亚洲科学院院士等将分享见解,知名投资机构将齐聚,还有企业展示成果、进行辩论,共探AI产业未来。

甲子光年
新闻资讯7

成都中专生,干出3500亿

AI东风下,新易盛靠光模块业务半年暴赚40亿,市值超3500亿。其掌舵者高光荣中专出身,近40岁创业。新易盛产能达历史高峰,机构看多助推估值飙升,同行也在风口起飞。

芯师爷
开源动态8

找了一圈,部署扣子的开源版本,还得是你

7月26日,Coze将旗下“扣子开发平台”和“扣子罗盘”开源,加上此前的Eino,其开源拼图逐步补齐。Coze Studio可开发AI Agent,Coze Loop能解决Agent生命周期问题,还可借助火山引擎一键部署,降低开发门槛。

MacTalk
算法论文8

Coding Agent 自主解题很强,但用户改一行代码就"翻车"?自所团队提出 SWE-Touch 揭示共享工作空间下的能力缺口

当前基于大模型的Coding Agent是热门研究方向,现有评测多假设其独占代码仓库。中科院自动化所团队构建SWE - Touch框架,对9个前沿模型测试,发现用户干预下模型性能下降、排名洗牌。

深度学习自然语言处理
算法论文8

长程任务飙升98%,斯坦福Skill原生LLM来了

普林斯顿、CMU、斯坦福、牛津等提出Skill-Native大模型,提出Skill Entropy度量技能切换难度,搭建Skill²-Bench评测,还将熵用作训练信号提出Skill-Entropy RL,提升多模型准确率,且技能熵可复用。

PaperAgent
推荐文章8

改写纳米光学底层逻辑!MIT学者搭建通用可重构光子平台

MIT助理教授唐皓凝构建可相对运动的双层纳米光子系统,将机械运动变为可定量科学变量。2024年,她和合作者集成光谱仪和偏振仪功能。她想发展可编程光子架构,还把AI作工具。

DeepTech深科技
推荐文章8

Codex 负责人:「所有人都是 builder」是个很糟糕的主意

OpenAI Codex 团队负责人 Andrew Ambrosino 认为,AI 时代产品开发各环节发生变化,实现成本降低,品味变得更重要。他还谈到岗位角色融合但 PM 不会消失,以及 Codex 发布时机和工作模式等问题。

Founder Park
开源动态8

真可用!美团数字人模型开源,MV、电商等统统拿下

美团开源数字人视频生成框架 LongCat - Video - Avatar 1.5 版本,换音频编码器、加速推理,支持多任务与多场景。经770人评测,它在多维度领先对手,各方面表现均衡,效率与质量兼得。

AIGC开放社区