供给侧思维」共找到 351 篇相关文章

算法论文8

ICML 2026|告别「单线程」思维,智能体进化出了原生的并行推理大脑

北京通用人工智能研究院语言交互实验室提出原生并行推理器NPR,它有「自蒸馏 + 并行强化学习」三阶段训练范式,配套并行推理引擎,让并行推理成模型原生认知能力,还介绍了其具体实现、实验结论等。

机器之心
算法论文8

让Agent画思维导图稳固长期记忆:新框架实现稳定长期学习,准确率提升38%

中国电信人工智能研究院研究团队提出TeleMem框架,从数据结构层重新设计Agent记忆组织方式,使记忆可检索、累积、回溯和演化。该框架解决了传统RAG在长期记忆管理和持续学习方面的瓶颈,准确率提升38%。

量子位
新闻资讯7

每周产业洞察 | AI影视文艺复兴已至,未来24个月内容供给将迎结构性变化

北京AIGC视听产业创新中心位于朝阳区,由多方参与、首创郎园负责运营,通过六大服务平台促进成果转化与场景落地。截至2025年8月已汇聚60余家生态伙伴,首创郎园拓展多地业务。

郎园Station
产品应用8

首个真正“能用”的LLM游戏Agent诞生!可实时高频决策,思维链还全程可见

超参数科技推出全新游戏智能体COTA,它由大模型原生驱动,操作似职业选手,决策如教练,推理链路清晰。在自研FPS游戏Demo中表现出色,还打破‘不可能三角’,有望重构游戏人机关系。

量子位
新闻资讯8

OpenClaw创始人:80%的应用会消失,花哨的AI工作流只会生产垃圾,工程思维才是超能力

OpenClaw创始人Peter Steinberger表示,OpenClaw这类AI助理将取代手机上80%的应用。他分享OpenClaw诞生过程,其能远程修复Bug等。他还批判花哨AI工作流,认为人类品味不可或缺,建议学习AI要去玩。

AI寒武纪
算法论文7

AI仅凭“自信”学会推理,浙大校友复刻DeepSeek长思维链涌现,强化学习无需外部奖励信号

UC Berkeley团队提出新训练方法Intuitor,大模型无需接触真实答案,仅优化自身信心就能学会复杂推理。该方法无需外部奖励信号或标注数据,用模型自身置信程度作内在奖励信号,在多任务表现良好。

量子位
算法论文8

突破具身智能“专家困境”!北大新方法让宇树G1靠单一框架掌握跳舞和手翻

北京大学与BeingBeyond团队联合研发的BumbleBee系统,用创新的‘分治 - 精炼 - 融合’三级架构,实现人形机器人在多样化动作中的稳定控制,破解传统控制策略的‘专家困境’与‘现实鸿沟’。

量子位
开源动态8

会“思考”的目标检测模型来了!IDEA提出Rex-Thinker:基于思维链的指代物体检测模型,准确率+可解释性双突破

现有目标检测方法有决策不透明和拒识能力不足问题。IDEA提出Rex - Thinker,引入“逻辑推理链”,构建可解释推理框架,经两阶段训练,在测评中准确率提升,可解释性强,有良好泛化能力。

机器之心
开源动态8

0.5B以小搏大拿下端模型新SOTA:4090可跑,长文本处理5倍常规加速丨清华&面壁开源

清华大学和面壁智能团队开源MiniCPM 4,有8B、0.5B两种参数规模,以22%训练开销达同级别最优。它在架构、推理、数据、训练多方面创新,性能领先,适用于综述生成、工具调用等场景。

量子位
开源动态8

字节开源了一款多模态神器!BAGEL上线,超越Qwen2.5-VL,媲美SD3!

多模态AI发展进入新阶段,字节跳动开源通用多模态大模型BAGEL。它支持多模态输入输出与思维链推理,性能超Qwen2.5 - VL等,安装使用友好,有多种应用场景。

开源星探