「多语言大模型」共找到 9919 篇相关文章
成本暴降88%!通义实验室、北大发布ZeroSearch,无需搜索即可激活LLM检索能力
信息检索能力对提升大语言模型推理表现至关重要,但现有方法在训练中面临文档质量不可控和搜索 API 成本高昂两大挑战。为此,通义实验室和北大提出 ZeroSearch 框架,无需真实搜索即可激活 LLM 检索能力,显著降低成本。
ICLR 2026 | LongHorizonUI:让 GUI 智能体不再"半途而废"——面向长链路任务的统一鲁棒自动化框架
近年来,基于多模态大语言模型的GUI智能体在自动化操作上虽有进展,但任务步数超10 - 15步时成功率断崖下跌。研究人员提出LongHorizonUI框架,构建LongGUIBench评测基准,推动GUI自动化在复杂场景落地。
承认自己开源不行?转型“美国DeepSeek”后,两个谷歌研究员的AI初创公司融到20亿美元,估值暴涨15倍!
AI创业公司Reflection AI由两位前Google DeepMind研究员创立,一年完成20亿美元融资,估值达80亿美元。它从编码智能体起步,现转型为开源替代公司,主打“开源”牌,计划明年推前沿语言模型。
首个面向科学任务、真实交互、自动评估的多模态智能体评测环境,ScienceBoard来了
ScienceBoard是首个面向科学任务、真实交互、自动评估的多模态智能体评测环境。它集成多领域科研软件,构建科研任务集合,评估智能体在科学任务上的表现,发现现有模型在科研工作流中远未成熟。
冲159K星 OpenClaw工具链,正在悄悄改变Agent玩法
Clawdbot更名openclaw后在github星冲到159K。它能让AI深入工作流且保数据隐私,有集成渠道多、工具齐全、有状态会话与持久记忆、路由策略适配不同模型等核心能力,并在多方面优于常见AI工具。
三大核心创新公开,快手开源多模态Keye-VL 1.5拿下视频理解SOTA,8B力压GPT-4o!
快手开源多模态Keye-VL 1.5,为8B视频理解大模型,公开3大核心创新技术。靠Slow - Fast视频编码等,在20 + 基准屠榜。它能精确视频定位,实验显示通用、视频理解和数学推理表现佳。
周杰伦发的1400万人点赞的AI视频,是怎么做出来的?
周杰伦抖音首条1400多万点赞的AI视频,将其人生节点与专辑串联,有史诗叙事感。文章介绍用AI视频首尾帧功能制作视频的方法,还举例岳云鹏、《甄嬛传》、科比等,称AI能倒转时空。
横扫八大数学竞赛:清华微软联合提出STAR-PólyaMath,Apex基准超GPT-5.5 13.5%
清华大学与微软亚洲研究院团队提出推理多智能体系统 STAR - PólyaMath,构建探索 - 推理 - 验证框架,解决大模型长程数学推理瓶颈,在八大数学竞赛基准获最优成绩,还可泛化到其他推理场景。
企业级靠谱龙虾升级,拒绝失控
OpenClaw爆火又降温,凸显轻量化智能体短板,企业需具精准业务理解和多技能协同能力的AI员工。滴普科技升级Deepexi企业大模型,其与两平台构成DeepexiOS,支撑企业AI体系化建设。
「AI助手」真来了?谷歌牵头推进Agent支付协议AP2
近日谷歌宣布推出 Agent 支付协议 AP2,这是开放共享协议,为 Agent 和商家交易提供通用语言,解决授权、真实性、问责问题,还支持多种支付类型,已和 60 多个企业合作且在 GitHub 公开项目。