「空间智能评测」共找到 4206 篇相关文章
小红书发布 SWE-Bench Mobile:当 AI Agent 面对亿级用户 App 代码库,最高通过率仅12%?
小红书联合多科研机构发布 SWE-Bench Mobile,它是首个还原‘端到端’开发流程的基准,以小红书 App 实际任务为核心。评测显示,AI Agent 在移动端开发能力上限低,架构设计比模型本身重要,简单提示策略效果更好。
开源版 Cowork 项目在 X 爆火,创始人:感谢 Cowork,让我们三年的探索被看到
Anthropic的智能体工具Cowork在X上爆火,CAMEL AI的开源项目Eigent作为平替也跟着火了一把。文章复盘了CAMEL AI从2023年发布CAMEL框架到Eigent项目的三年探索经历,介绍了Eigent的产品设计、技术架构、应用场景及发展情况。
5秒完成3D场景编辑,北大&港中文&上海AI Lab搞出VGGT-Edit,120倍加速太炸了
北大、港中文等团队提出原生3D编辑框架VGGT-Edit,不再绕回2D,直接在3D空间编辑。它采用残差场预测等机制,在DeltaScene测试集表现出色,单次编辑约5秒,最高120倍加速。
刚刚,百度最新开源神作:PaddleOCR-VL-1.5上线了
1月29日百度开源新一代文档解析模型PaddleOCR-VL-1.5,参数仅0.9B,在OmniDocBench V1.5评测中综合性能全球第一,精度达94.5%。它支持异形框定位,解决真实文档解析难题,在多场景表现出色。
cursor翻车了,Anthropic:来,我教你怎么做long running Agent。
近期,Cursor宣称用大量智能体实现长程任务引发关注,但被指是营销惨案,代码存在诸多问题。Anthropic则分享务实的long - running思路,是记忆接力模式,代码可维护。未来模型能力提升或让代码成黑箱。
英伟达2026奖学金,8位华人博士统治榜单!人均6万美金
2026 - 2027年度英伟达研究生奖学金名单揭晓,10位获奖者中华人学者占8席。该奖学金提供最高6万美金科研经费与暑期实习机会。研究方向涵盖神经渲染、AI安全等,体现英伟达关注具身智能和AI安全。
从Demo到行业落地的Agents:技术、应用与评估
通用LLM Agent工业落地有短板,哈工大深圳与华为提出L1 - L5工业Agent能力成熟度框架,映射技术演进与产业场景,覆盖50+行业案例、300+评测基准,给出可量化‘爬级’路线。
Crossplane 2.0 发布:在云基础设施之上全面支持应用管理
Crossplane 开源项目发布 2.0 版本,将管理范围从云基础设施拓展到应用与基础设施协同编排。解决了基础设施与应用需分开管理的问题,新增应用支持,改进组合资源,采用命名空间优先设计,还引入新 Operation 类型。
小扎“亿元俱乐部”车门焊死!被曝冻结招聘,禁止内部人员流动
Meta超级智能实验室被曝冻结招聘,禁止员工跨团队调动。此前Meta大举招人,现因新老员工矛盾、AI部门重组及市场对“AI泡沫”担忧等因素调整战略,虽AI投资有收益,但仍需评估。
上海AI实验室发布『书生』具身全栈引擎,推动机器人大脑进入量产时代 | WAIC 2025
上海AI实验室发布『书生』具身全栈引擎Intern - Robotics并开放,它有一脑多形、虚实贯通、训测一体等创新。还启动‘具身智能光合计划’,15家企业机构已加入,助力解决行业难题,推动具身大脑量产。