长程规划」共找到 414 篇相关文章

产品应用7

AI Agent做PPT卷疯了,最强选手被挖掘出来了

2025年是AI Agent元年,做PPT成成果显著领域。Agent能自主完成PPT全流程,解决此前导出编辑难题。文章对比GenSpark、天工Agent等产品在不同场景做PPT的表现,为用户选择提供参考。

鲸选AI
算法论文8

LeCun发布最新世界模型:首次实现16秒连贯场景预测,具身智能掌握第一视角!还打脸用了VAE

LeCun团队推出PEVA模型,让具身智能体学会人类“预判能力”,首次实现16秒连贯场景预测。它结合结构化动作表示与条件扩散Transformer,用真实数据训练,解决长时序问题,还能筛选最优动作。

量子位
算法论文7

63页的面向AI搜索范式:Multi-agent、MCP、DAG、RL

百度搜索发布63页《迈向人工智能搜索范式》Paper,介绍模块化、多智能体框架,新范式协调四个专门LLM代理处理搜索事务,还提及新内容及重要性,为下一代AI搜索系统提供基础。

PaperAgent
推荐文章7

我在Facebook工作四年的总结与反思

作者分享在Facebook四年工作的总结反思。包括目标规划、工作价值判断、处事态度、技术与产品关系等多方面体会,如明确目标、做有价值工作、少片面结论等。

海边的拾遗者
产品应用8

AI4S开始进入「项目时代」:紫东太初把AI从做Task推向做Project

AI for Science进入新阶段,中科紫东太初旗下ScienceClaw升级,推出AutoProject引擎,让AI从执行Task转向做Project,具备规划、执行、验证等项目级自主科研能力,推动行业范式升级。

量子位
开源动态8

开源SOTA!商汤原生多模态一个大脑完成看图、推理、作画

商汤开源日日新SenseNova U1,用NEO - unify架构让像素和文字自由协作,多项指标达开源SOTA,适配10家国产芯片。它能完成看图、推理、作画等多任务,虽有局限,但后续优化值得期待。

AIGC开放社区
推荐文章7

用好Agent最重要的技巧不是Skills,是这四个字。

作者分享使用Agent心得,强调“约束先行”,以Claude Code工作文件夹混乱为例,阐述顶层约束的重要性,介绍其规则体系,还展示全局CLAUDE.md文档,指出约束能让Agent工作更有序。

数字生命卡兹克
算法论文7

Transformer学不会多位数乘法?MIT和哈佛的研究指出了一个简单漏洞

MIT、哈佛和谷歌DeepMind团队实验发现,Transformer做4位数乘法有软肋。用‘隐式思维链’(ICoT)训练的模型准确率达100%,传统方法仅1%。研究揭示了问题根源,还给出修复方案,但也引发诸多质疑。

AI工程化
算法论文8

解码提速15.1倍、多任务性能不降:复旦&引望WAM-Diff2打通自动驾驶VLA自回归—扩散转换

视觉-语言-动作(VLA)模型是端到端自动驾驶主流技术,但自回归解码架构有瓶颈。复旦大学与引望智能联合提出WAM-Diff2,实现自回归VLA向离散扩散模型迁移,解码加速15.1倍,多任务性能不降。

机器之心
推荐文章7

所有Harness终将长成“龙虾”,但最后活下来的只有几只

在用户需求驱动下,工具从 LLM 向 Agent、Harness 再到 Claw 自然进化,但用户能容纳的 Claw 有限。Sam Bhagwat 拆解进化路径,指出各阶段核心竞争力,开发者应抢占用户心智空间。

InfoQ