「多任务处理」共找到 5753 篇相关文章
3D-R1:让AI理解3D世界的下一步
文章介绍新研究3D - R1,它是更通用、具推理能力的三维视觉语言模型,解决了当前3D VLM空间理解不足与推理能力薄弱问题,在多任务测试领先,有广阔应用前景。
大模型首次打破围棋思维「黑盒」,打通科学发现新路径!上海AI Lab发布新一代InternThinker
上海AI Lab发布新一代书生·思客(InternThinker),它是我国首个具围棋专业水平且能展示透明思维链的大模型。其得益于InternBootcamp训练环境,还在多任务混合训练中现‘涌现时刻’,背后有通专融合底层技术突破。
【实测&解读】全球首个手机通用Agent——AutoGLM 2.0发布!我喝到了AI为我点的第一杯咖啡~
智谱更新的AutoGLM 2.0是全球首个手机通用Agent,适配苹果和安卓手机,无需交出手机使用权。它配备云手机和云电脑,由GLM - 4.5和GLM - 4.5V驱动,能完成点咖啡等多场景任务,因风险控制付款需人确认。
解决智能体手工构造难题! 浙大&腾讯提出 ReCreate,从零自动构建领域智能体
浙大、腾讯等机构研究者提出ReCreate框架,不依赖手工设计,让智能体自主构建。它从交互经验中找优化方向,有三重设计,实验显示能提升多领域任务通过率、降成本,未来或开启AI“自我制造”时代。
八年后,Meta教会了Transformer「显式思考」
10月20日Meta上线新论文《The Free Transformer》,作者François重写Transformer思维方式,造出Free Transformer新架构。它在解码器内加入随机潜在变量,让模型生成内容前先‘思考’,实验显示在多任务上性能显著提升。
高效大规模创新3D重建模型iLRM
多数基于Transformer架构的模型处理多视图输入有可扩展性问题,成均馆大学、延世大学研究人员提出创新3D重建模型iLRM。它通过迭代细化机制生成3D高斯表示,有独特架构设计和高效注意力机制。
提示工程死亡?不,它刚刚重生为计算科学:一篇讲透Prompt设计的科学基础
大型语言模型在多步推理任务中受挫,因Transformer架构有计算深度限制。本文建立提示设计理论框架,揭示提示是信息选择器,优化提示可使推理性能提升超50%,将提示设计从试错艺术变为可计算科学。
嘘,Claude正在「做梦」!睡一觉疯狂进化,一夜暴涨6倍战力
Anthropic在Code with Claude开发者大会上,给Claude托管智能体添加Dreaming功能,让其能自动回顾记忆、自我进化,还发布Outcomes和多智能体编排。法律AI公司Harvey用后任务完成率飙升约6倍。Anthropic还租下22万张GPU算力。
全能高手&科学明星,上海AI实验室开源发布『书生』科学多模态大模型Intern-S1 | WAIC 2025
7月26日,上海AI实验室在WAIC 2025上发布并开源『书生』科学多模态大模型Intern-S1。它首创‘跨模态科学解析引擎’,在多学科专业任务基准上超越顶尖闭源模型,还具备体系化技术创新。未来将持续开源,打造更懂科学的AI助手。
红杉对话 LangChain 创始人:2026 年 AI 告别对话框,步入 Long-Horizon Agents 元年
红杉访谈 LangChain 创始人 Harrison Chase,探讨 Long-Horizon Agents。其认为 2026 年是 Doers 元年,这类 Agent 能处理长时程任务。还提及 Harness 架构、Coding Agent 等,指出 Memory 是壁垒,交互需同步与异步结合。