「赋能」共找到 5082 篇相关文章
斯坦福:优化器「诸神之战」?AdamW 凭「稳定」胜出
斯坦福大学 Percy Liang 团队研究指出,虽有不少声称能显著加速的优化器替代方案,AdamW 仍为预训练稳健首选,但矩阵型方法在特定数据–模型比例下优势明显。研究还揭示了现有研究的方法论缺陷。
AI读网页,这次真不一样了,谷歌Gemini解锁「详解网页」新技能
谷歌在Gemini API上线URL Context功能,能让Gemini模型访问并处理URL内容。与普通扔链接给AI不同,它可深度完整解析文档。有深度解析PDF等能力,被指或成RAG替代方案,也有能力边界。
2.1K星CCPM:多Agent任务,流水线一样并行Coding
CCPM基于GitHub Issues + Git worktrees,有严格五阶段流程。多agent负责同一issue不同子任务,实现任务级并行,最高提升3倍交付速度,75%降低Bug率,还能避免上下文丢失等问题,有详细工作流程和命令。
首个为手机而生的通用 Agent?!苹果做不到的事,“野路子”智谱抢先实现了
苹果预计 2026 年升级 Siri 实现自主行动,但完整落地的执行型 Agent 未推出。8 月 20 日智谱发布 AutoGLM 2.0,称是全球首个可在手机用的 Agent,开创‘Agent + 云手机 / 云电脑’范式,能代理操作高频应用。
波士顿动力 | 人形机器人Atlas ,最新研究进展!
世界人形机器人运动会引发对自主机器人的讨论。波士顿动力与丰田研究院合作为 Atlas 开发大型行为模型(LBM),使其能自主完成复杂任务,研究团队展示成果并介绍模型构建流程、实践成果及研发原则。
超10亿人民币!芯擎科技完成新一轮融资,获得两省首单AIC
近期,芯擎科技宣布完成超10亿元B轮融资,获湖北、山东两省首单AIC股权项目。它是国产智能座舱芯片市占率第一,能覆盖智能座舱到智能驾驶。创始人称将加大研发,推动汽车智能化。
联合理解生成的关键拼图?腾讯发布X-Omini:强化学习让离散自回归生成方法重焕生机,轻松渲染长文本图像
图像生成领域,自回归与扩散模型技术路线之争不断。腾讯混元团队发布X-Omni模型,通过强化学习提升自回归图像生成质量,能渲染长文本图像。该模型已开源,还构建奖励系统评估生成质量。
强化学习+MCP=王炸?开源框架教AI在MCP中玩转工具解决任务,实测效果超越GPT!
科技公司OpenPipe提出全新开源强化学习框架MCP·RL,只需一个MCP Server地址,agent就能自动发现工具、生成任务,在闭环反馈中摸索出最优调用策略,实测在2/3的benchmark上达或超SOTA性能。
X-Actor 惊艳登场!长时唇动+情感同步人像动画生成
字节提出 X - Actor,一个音频驱动自回归扩散框架,能通过一张静态参考图像和一段音频生成逼真、富有情感表达的人像动画视频。其核心是两阶段解耦生成流程,实现长时间唇形同步与情感音频一致性。
Anthropic CEO:模型可在一亿上下文窗口中学习,且不改变权重,未来AI将每月10万美元
Anthropic CEO Dario Amodei预测几年内将出现月费10万美元、支持1亿词上下文窗口的AI模型。Google Research论文揭示LLM能在不改变权重下,通过「临时便签」机制学习,还介绍了其原理与实验验证。