「工作成果考核」共找到 1658 篇相关文章
全日程公布|谷歌Veo 3惊艳发布后,这场CVPR分享会值得每个AI人「听个声」
谷歌在 I/O 2025 大会发布 AI 视频生成模型 Veo 3,实现音画同步。为让从业者了解 AI 新成果与趋势,机器之心 6 月 8 日将举办「CVPR 2025 论文分享会」,公布全日程、嘉宾及主题,还会直播。
ECCV 2026 | 一段视频,重建一个可仿真的动态世界
机器人走出实验室后,训练数据需覆盖真实世界情况。OVOW由多团队完成,被ECCV 2026接收。它从单目视频出发,输出可编辑、可碰撞的实例级Mesh,串联视觉基础模型完成流水线工作,能用于物理仿真。
Loop世界模型论文登顶Hugging Face,来自中国一家初创,周鸿祎陆奇都投了
Prompt还没退场,Loop已开始接管AI叙事。Loop Engineering突然爆火,而Looped World Models(循环世界模型)技术含金量更高,其论文登上Hugging Face Papers当日Top1。该论文由中国初创公司脸谱心智完成,成果显著。
AI 时代的新可观测性:不只看系统崩没崩,还要看模型有没有胡说
New Relic首席技术战略官Nic Benders与主持人探讨可观测性从传统到AI驱动的演进,提及LLM与统计方法协同处理海量数据,还讨论了监控AI系统的难题及可观测性核心是理解业务目标。
从“一句成片”到“长轨推演”:探究多模态智能体在长视频编辑中的应用
近年来大语言模型在长篇视觉叙事中潜力卓越,但长视频剪辑仍难控制。中科大等团队开源工作从系统工程视角研究多模态智能体在长视频编辑中的机制,重构剪辑管线,找到症结并给出解决办法。
双榜SOTA!微软ACL2026新作重新定义AI长记忆
大语言模型落地中,AI长期记忆能力成瓶颈,传统RAG方案有局限。微软研究团队提出AI记忆框架Mnemis,受认识论与认知科学启发,在两大权威长期记忆基准达SOTA性能,工作被ACL2026主会议接收。
Claude不到4%,全军覆没!一场大考撕碎Agent「全自动办公」幻想
新智元报道,UniPat AI的SaaS - Bench实战考卷,用23个真系统、106个任务测试Agent。结果显示,Claude Opus 4.7完全通过分数仅3.8%,多数模型全军覆没,暴露了Agent在真实环境中的四种致命缺陷。
Claude Code 推出 Agent View 功能,一键管理所有会话
Claude Code 推出 Agent View 功能,可同时派出一群 AI agent 干活,在一个屏幕管理所有会话。通过 `claude agents` 命令,能让各会话互不干扰工作,界面按状态分组展示,还能就地回复、随时进出,且后台跑不会断。
ICSE 2026杰出论文 | 突破代码模型真实工程落地瓶颈,北大团队提出SEAlign对齐框架:显著提升软件工程智能体决策质量
现有代码模型在经典基准表现好,但在真实软件工程环境表现差。北大金芝、李戈团队提出 SEAlign 框架,通过识别与对齐智能体轨迹关键决策点,提升模型在真实工程任务表现,成果获 ICSE 2026 杰出论文奖。
Demo秀终结,机器人连干8小时不歇!智元定义「部署态」
4月17日智元合作伙伴大会上,智元创始人定义2026为「部署态」元年,即机器人在真实场景7×24小时自主干活。大会首提XYZ曲线产业发展框架,还发布七大生产力解决方案,展示四大新本体、六大AI模型等成果。