人在循环中」共找到 8866 篇相关文章

算法论文8

强化学习没作用?大DelTA精准识别关键token,推理正确率大幅上升

大高瓴研究团队提出DelTA算法,不依赖经验为强化学习目标中每个token算最优权重。实验显示它适配主流强化框架,多任务上提升base模型效果,还能让训练更稳定。

量子位
算法论文8

给 Agent Skills 装上眼睛:MMSkills 用多模态技能包教会智能体看状态、做决策

上海交通大学和小红书团队推出面向通用视觉 Agent 的多模态技能框架 MMSkills,将可复用技能扩展为多模态程序性知识,通过 branch loading 调用视觉证据, GUI 与游戏任务评测中表现出色。

深度学习自然语言处理
算法论文8

马斯克惊叹!DeepSeek和Kimi先后出手,捅破了Transformer的「潜规则」!

文章介绍了DeepSeek和Kimi残差连接上的突破。DeepSeek让连接权重可学习,用数学约束保证稳定性;Kimi将注意力机制用于层间连接,解决了更根本的问题,性能提升显著。

花叔
算法论文8

用Diffusion构建「AI虚拟细胞」,14项指标霸榜!Mila唐建团队破解单细胞「破坏性」测序难题

Mila唐建团队发表PerturbDiff,跳出前认知盲区,将“细胞群体的概率分布”视为随机变量。它引入数学工具建模,让MMD内生于体系,多项基准测试霸榜,还提供应对数据稀缺的思路。

量子位
算法论文7

多智能体大语言模型中的类自适应协作

尽管大语言模型有进展,但纯自治多智能体系统有局限。为此提出 HILA 框架及双环策略优化机制,结合 DLPO 的 HILA 基准测试中表现出色,为构建 Agentic 系统提供指导。

深度学习自然语言处理
新闻资讯7

OpenAI认怂了:ChatGPT推广告?我们真没这意思,纯属设计失误

12月1日,ChatGPT Pro付费用户界面弹出应用推荐卡片引不满。早有添加广告预兆,Sam Altman态度转变。OpenAI称是应用建议,用户不买账,功能已暂停,而同期ChatGPT商业化价值也显现。

AI工程化
算法论文8

Meta通过简单算术解锁LLM SoTA性能

大型语言模型训练耗算力与时间,传统模型融合方法有局限。本文提出SoCE新方法,通过筛选专家模型、非均匀加权平均融合,多评测中实现先进性能,为LLM优化提供新思路。

深度学习自然语言处理
算法论文8

NeurIPS 2025 | 北大联合小红书提出Uni-Instruct:ImageNet单步生图FID进入1.0时代!

北大联合小红书提出的 Uni - Instruct 框架被 NeurIPS 2025 接收,它统一超 10 种单步扩散模型蒸馏方法,多项任务达最佳性能,还能用于文本到 3D 生成。

机器之心
新闻资讯7

创新中心 | “影视AIGC实战进阶”专题活动,亮相第八届初心榜!

AIGC全面融入影视产业,重塑创作方式等。‘AIGC影视应用专题对话’作为第八届初心榜青年视听展重要环节,将首创·郎园Station举行,汇聚多领域力量探讨影视AIGC落地实践。

郎园Station
新闻资讯8

Google推出 AI 科学家:自动编写专家级代码,40个新方法碾压类 SOTA

Google新发布的AI系统能编写科学软件、发明新方法,结合大语言模型与树搜索技术。生物信息学、流行病学等多领域超类最优水平,引发网友对科研影响的讨论。

AGI Hunt