多阶段推理系统」共找到 4053 篇相关文章

开源动态8

小米陈龙团队首作:统一具身与自动驾驶的开源模型

小米具身智能团队发布首篇论文,提出统一具身智能与自动驾驶的新模型MiMo-Embodied。该模型在多任务中领先,其四阶段训练框架打通两领域边界,为行业提供新范式。

AI科技评论
推荐文章8

这一年做 Agent 的公司,Coding 赚了钱,客服融了钱,你呢?

全球数据研究机构 CB Insights《AI Agent Bible》报告梳理 Agent 行业概况。指出未来趋势,如语音成主流交互等;分析发展受限问题、有潜力机会;还介绍不同类型 Agent 商业情况及应对推理成本策略等。

Founder Park
算法论文8

双管齐下:联邦学习防投毒攻击与梯度泄露,华南理工深北莫研究成果登上TMC与IoT

随着联邦学习在物联网系统广泛应用,数据隐私保护成难题。华南理工大学与深圳北理莫斯科大学合作,提出FedMSBA和FedMAR两种防御方法,分别解决参与方梯度泄露和服务器受攻击问题,在多方面实现突破。

新智元
开源动态8

字节跳动开源超强USO模型,AI绘图六边形战士来了

在AI图像生成领域,风格和主题驱动的图像生成一直脱节。字节跳动智能创作实验室推出USO模型,构建海量数据集,设计两阶段训练法,引入风格奖励学习范式,化解此难题,且已全面开源。

AIGC开放社区
算法论文8

强化学习的两个「大坑」,终于被两篇ICLR论文给解决了

现有强化学习算法基于理想化交互模式,难应对真实环境。Mila 实验室两篇 ICLR 2025 论文提出实时强化学习框架,分别解决推理延迟和动作缺失问题,还可结合使用,对关键领域意义重大。

机器之心
产品应用8

实测首款3D AI伴侣EVE - 我收到了AI送的第一杯奶茶。

作者拿到EVE内测资格,分享体验。它是游戏化AI陪伴应用,有好感度、记忆等系统,有活人感和主动性,还能用Agent点奶茶。作者认为它是AI娱乐赛道希望,展现AI娱乐、生活体验。

数字生命卡兹克
算法论文8

腾讯网关TGW:用户无感知快速迁移及故障自愈能力 | USENIX ATC '25

腾讯与清华联合论文入选USENIX ATC '25,阐述稳定运行多年的TGW网关架构,展示无损迁移、故障自愈及定位系统。该架构应对业务流量挑战,有高性能、高可用等特性,还分享运营经验。

腾讯技术工程
开源动态8

字节清华智能体自动写CUDA内核,比torch.compile加速2.11倍

字节Seed与清华AIR团队开源CUDA Agent,在GPU内核优化基准KernelBench上成绩优异。它是大规模智能体强化学习系统,训练数据经多阶段构建,分阶段训练,全面超越商业模型,还开源了训练数据集。

量子位
开源动态8

10B超越Gemini-2.5-Pro!阶跃星辰端侧多模态天花板开源

阶跃星辰多模态智能团队开源STEP3-VL-10B多模态模型,仅100亿参数却性能惊人。它采用了独特的架构、训练策略与推理机制,在多任务上表现出色,为小模型发展提供新思路。

AIGC开放社区
算法论文8

硅基大脑记忆觉醒!会遗忘、会反思、会成长的AI正在到来

哈尔滨工业大学等机构团队发表研究,用认知神经科学视角审视AI记忆系统,探讨如何让AI产生“自我”,构建会遗忘、反思、成长的记忆大脑,还涉及记忆分类、存储、管理、评估、防御及未来演进等内容。

AIGC开放社区