多任务处理」共找到 5795 篇相关文章

产品应用8

面壁MiniCPM-SALA模型,稀疏-线性注意力,单卡吞吐百万上下文

面壁智能团队提出SALA,基于此训练的MiniCPM-SALA模型,在单张A6000显卡实现百万token超长上下文推理,训练成本降约75%。它结合稀疏与线性注意力,采用混合架构,继承权重降低成本,在长文本处理上优势明显。

AIGC开放社区
新闻资讯8

碾压小扎!22岁成亿万富翁,2025年AI造富速度刷新人类认知

2025年AI成超级造富机,将50位创始人送入亿万富翁俱乐部。从大模型到应用层,AI渗透生活。巨额融资不断,巨头砸钱建基建,人才争夺激烈,模态初创公司也受青睐,职场AI使用比例上升。

新智元
开源动态8

从「会表演」到「更会演」:KlingAvatar2.0让数字人拥有生动灵魂

近日快手可灵团队发布 KlingAvatar2.0 技术报告,数字人能‘生动表达’。它有三大创新技术,如时空级联框架等。实验显示其生动性大幅提升,性能超竞品,推动数字人在领域规模化应用。

机器之心
新闻资讯7

线性注意力回归!Kimi新模型引爆,MiniMax却悄悄换回传统架构

LLM领域线性注意力机制正在回归,工程实践主要由国产模型推进。早期线性注意力因牺牲精度未获主流认可,今年下半年个国产模型采用其变体,MiniMax却又换回传统架构,Kimi新模型带来新解法。

AI寒武纪
新闻资讯8

在云栖大会,一场关于AI Agent的变化正在发生|甲子光年

企业应用AI正从“调用模型”转向“构建AI Agent”。云栖大会展示了其在行业的应用,如教育、工业、零售等。不过,企业落地AI Agent面临技术、场景、合规和商业回报等挑战,阿里云提供了构建方案。

甲子光年
算法论文7

又一推理新范式:将LLM自身视作「改进操作符」,突破长思维链极限

Meta等机构研究者将LLM视为「思维」改进操作符,探究并行 - 蒸馏 - 精炼(PDR)推理方法。实验显示,PDR在数学任务中提升准确率,还训练8B模型让推理方法更适配,减少训练与部署的不匹配。

机器之心
新闻资讯8

躲了科学家几十年的流体不稳定奇点,被DeepMind用AI找到了

谷歌DeepMind与所高校合作,用物理知情神经网络(PINN)+高精度数值优化的方法,找到了流体方程里的不稳定奇点。这种奇点很“挑剔”,此前难寻踪迹,此次发现为非线性流体动力学研究提供新范式。

量子位
算法论文8

从单领域到能力协同:数据混合如何重塑AI的强化学习

上海AI Lab的OpenDataLab团队通过大规模实验剖析可验证强化学习(RLVR)在领域推理中的机制,发现逻辑与数学数据相互支持、代码推理有跨领域混合效应等,为构建AI推理模型提供关键发现。

深度学习自然语言处理
新闻资讯8

OpenAI杀疯了!内部神秘模型首次斩获信息学奥赛IOI 2025金牌,碾压98%人类选手

OpenAI研究员官宣其内部研发的AI推理系统在2025年国际信息学奥林匹克竞赛获金牌,超越98%人类选手。该系统在模拟人类环境下靠推理解题,用通用模型,一年间成绩大逆转,近期在赛事表现出色。

AI寒武纪
产品应用8

kimi 的RL end2end ON LLM

文章分享Kimi Researcher背后技术思考,采用端到端强化学习打造大模型Agent。对比传统方法,凸显其灵活通用、能力上限高、可扩展优势。还展示其在考试榜单成绩提升及智能“涌现”,介绍应用场景。

Agent的潜意识