「研究能力」共找到 4747 篇相关文章
T-RO综述重构Foundation Model时代机器人操作知识版图
近日,论文《Embodied Robot Manipulation in the Era of Foundation Models: Planning and Learning Perspectives》被IEEE Transactions on Robotics接收,它以High - Level Planning和Low - Level Action Modeling为主线,梳理Foundation Model时代机器人操作发展,分析了现存问题及关键缺口。
The Batch: 979 | LLM 清理智能体的“垃圾”
研究人员提出选择性管理智能体记忆之法,小红书Xubin Hao等构建Self - GC。它在送上下文给LLM前,让大语言模型决定内容取舍。测试显示其删历史少且保留必要细节能力强,不过未测其输出质量。
独家|清华团队组团创业,押注机器人端侧自进化,已完成首轮融资
过去一个多月,机器人学习风向生变。清华李健雄团队围绕机器人学习等研究多年后成立本溯智能创业。他们认为当下主流技术路线有问题,押注In - Context Learning,让机器人端侧自进化,降低部署成本。
小灵通老将再出山,这次要带着机器人冲刺IPO
8月24日,优地机器人通过港交所主板上市聆讯。它由UT斯达康前员工创立,近年商业模式调整,超半数收入非机器人直销。虽出货多但亏损,仍需提升产品毛利率和服务收入,加快现金回收。
突发!Opus 5.1被曝本周发布,最强AI智能体恐大洗牌
消息称Anthropic本周将发布Opus 5.1,其升级聚焦单Token智能水平,强化编程、推理、AI Agent能力;OpenAI 10万亿参数模型Bel完成预训练;企业选模型‘够用就好’,Anthropic Fable 5份额低。
给文档质量"打分":DIQA-5000 数据集与融合版面语义的 DocIQ 质量评估模型
文档图像质量评估(DIQA)是评判‘增强算法有没有把图变好’的关键工具。过去研究多围绕自然图像,缺文档专用数据集。本文提出DIQA - 5000数据集和DocIQ模型,补齐缺口。
说句话,造个3D世界!腾讯VibeWorlding氛围造世界
香港科技大学(广州)和腾讯团队开源VibeWorlding框架,实现说句话造3D世界。它由VWE - Bench和VibeWorlding - Gym组成,开源模型经强化学习训练后成绩逆袭,证明强化学习解锁3D推理潜力巨大。
我不认为几亿人会用豆包「办公」,但 Agent 豆包也必须要做
豆包工作任务新增本地电脑和云电脑切换模式,补上AI Agent关键工作条件,产品定位改变。其优势是低门槛且能力提升,虽Agent不够稳定,但有望成全民工具,推动AI进入大众生活。
3D指标超过Nano Banana Pro!浙大开源方案让AI在平面图像里进行立体编辑 | ACM MM'26
当前图像编辑模型处理三维状态常出错。浙江大学ReLER团队提出并开源PhyEdit,用显式3D几何preview指导图像编辑,还加入深度监督,构建数据集和评测基准,成绩超Nano Banana Pro,且GUI也开源。
分享一些可以让AI使用更丝滑的小技巧
作者起初用AI不顺手,经研究摸索发现是指令有误。分享沟通技巧,如给身份、给参考风格、用“说人话”“举例子”,还可当头脑风暴搭子,强调清晰指令能助自我认知。