「大模型Agent」共找到 10685 篇相关文章
PAS刊发西工大张伟伟教授智能流体力学重磅综述论文
西工大张伟伟教授团队受主编邀请,系统调研人工智能与流体力学交叉领域进展。通过科学计量学方法,展示发展脉络、现状与前沿方向,分析研究格局、梳理团队,为该领域提供全景图。
Sam Altman邮件证实,OpenAI将开发硬件语音AI Agent
今天凌晨,OpenAI的Sam Altman回应删除与Jony Ive信息一事,公布与iyO交涉邮件,透露收购io是为开发硬件语音AI Agent。iyO曾邀OpenAI投资、合作,演示失败后被弃,双方因名字打官司。
业界对 Agent 的最大误解:它能解决所有问题
业界认为 AI Agent 规模应用“拐点时刻”已至,但 IBM 强调不必过度“神化”AI。其推出 watsonx Orchestrate 解决方案,还指出企业落地 AI 要考虑数据、流程自动化等问题,强调回归业务本质看技术价值。
刚刚,字节开源Seed-OSS-36B模型,512k上下文
深夜,字节跳动Seed团队开源Seed-OSS系列模型,含三个版本。其用12万亿tokens训练,在多基准测试表现出色。有灵活推理预算控制等特性,原生支持512K上下文窗口,基准测试成绩佳。
刚刚,DeepSeek官宣V3.1发布,Agent 能力较大提升
DeepSeek官宣V3.1发布,核心特性有混合推理架构、思考效率提升、Agent能力增强。产品形态含官方App/网页端和API升级。性能在编程、搜索智能体及思考效率上显著提升。
Talking-Critic奖励模型带来更自然的音频驱动肖像
近期音频驱动肖像动画技术发展快,但现有方法存在嘴型声音不对、动作不自然等问题。阿里提出Talking - Critic奖励模型,构建Talking - NSQ数据集,还提出TLPO优化框架,提升多维度表现,实验超现有SOTA方法。
连OpenAI都在偷偷重仓!大模型的下一站,是「入侵」人类大脑
AI巨头入局使脑机接口升温,格式塔科技获1.5亿融资刷新中国纪录。全球超声赛道投资热,OpenAI等参与。超声波路径优势多,格式塔聚焦医疗,产品有望落地,AI融合是关键,未来脑机接口或成基础设施。
不用额外缓存!英伟达开源大模型记忆压缩方案,128K上下文提速2.7倍
英伟达联合多机构推出TTT - E2E方法,在长文本处理上提速显著且性能不打折。它基于标准Transformer,将长文本建模转为「持续学习」任务,核心是上下文压缩,避免额外缓存,代码和论文已开源。
抛弃“级联”架构!快手OneRec用大模型重构推荐系统,服务成本降至1/10
传统级联式推荐架构有瓶颈,快手用OneRec重构推荐链路,服务成本降至1/10。文中介绍OneRec架构、Tokenizer方案、强化学习奖励设计,还提及优化及多模态联合训练方向。
ACL 2025杰出论文!用能力显著向量让大模型下游任务性能预测更精准
上海人工智能实验室与复旦大学联合研究成果《Capability Salience Vector》获ACL 2025杰出论文奖。提出能力显著向量(CSV)解决验证损失与下游任务能力脱节问题,实验验证其提升了下游任务表现可预测性。