显著性方法」共找到 1244 篇相关文章

算法论文8

ICML 2025 Spotlight | 快手、南开联合提出模块化双工注意力机制,显著提升多模态大模型情感理解能力!

情智兼备是人工智能发展向,但多模态情感数据语义复杂,建模跨模态关联是挑战。快手可灵团队与南开提出模块化双工注意力范式,构建‘摩达’模型,在多任务测试中能提升,成果被 ICML 2025 收录。

AI前线
开源动态8

超长推理还能节省计算!Salesforce开源神器两连发:教大模型边想边省,显著提升数学编程准确率

Salesforce AI Research开源Elastic Reasoning和Fractured Sampling。前者将推理流程分两部分,分配token预算,使输出缩短、准确提高;后者打碎推理链条,从三维度采样,以更少tokens换更高准确率,均提升数学和编程任务准确率。

量子位
算法论文8

GRPO训练不再「自嗨」!快手可灵 x 中山大学推出「GRPO卫兵」,显著缓解视觉生成过优化

GRPO在视觉生成流模型后训练阶段有显著提升,但clip机制存在系统偏差,易使模型陷入过度优化。中山大学、快手可灵等团队提出GRPO - Guard,能降低过度优化风险,在多种任务中表现良好。

机器之心
开源动态8

SGLang Team:在 96 个 H100 GPU 上部署具有 PD 分解和大规模专家并行的 DeepSeek

本文介绍 SGLang 团队在 96 个 H100 GPU 上部署 DeepSeek 的法。利用 PD 分解和大规模专家并行,SGLang 实现高吞吐量,成本低。博客探讨并行设计、优化法,所有组件开源,也指出了当前局限与未来向。

GiantPandaLLM
推荐文章8

内核级的真相:为什么 eBPF 正在取代基于用户空间的 Agent 成为安全可观测的首选

文章指出基于用户空间的安全 Agent 存在与威胁同权限层级、CPU 成本高、易被攻击等问题。eBPF 能在 Linux 内核运行受沙箱保护程序,可降成本、增可见。上线应分阶段,还介绍工具及部署安全措施。

InfoQ
新闻资讯7

独家丨清华00后团队「零次机器人」获超亿元融资,聚焦可真实落地的具身智能

AI科技评论独家消息,零次机器人近日完成超亿元融资,由润泽集团领投。该公司由清华00后创办,团队超百人。已实现单月量产百台,订单破亿,推出具身操作基础模型,融资将用于软件、硬件和生态建设。

AI科技评论
算法论文8

告别微调!腾讯提出Training-Free GRPO:无需更新参数,还能保证泛化,成为传统RL的有力替代

大型语言模型在专业领域表现不佳,传统微调法成本高、易过拟合。腾讯优图实验室提出Training - Free GRPO,无需更新参数,通过上下文学习提升能,成本低且泛化好,是传统强化学习有力替代。

深度学习自然语言处理
算法论文8

GUI定位还在玩「非黑即白」?浙大团队提出GUI-G²,显著提升GUI智能体定位

在人工智能领域,GUI 智能体成技术风口,但现有 GUI Grounding 法有缺陷。浙大团队提出 GUI - G²,将 GUI 交互转变为连续空间建模,在三个主流 GUI 定位基准测试中表现亮眼,重新定义了 GUI 交互本质。

机器之心
推荐文章7

Sam Altman:温和奇点

Sam Altman认为人类已跨过临界点,构建出超人类智能系统,虽未现科幻场景,但显著提升生产力。预计2025 - 2027年AI有重大进展,奇点是渐进过程,要解决安全与可及问题。

深度学习自然语言处理
算法论文8

大模型“精细化”对齐,真实提升25.8%刷新SOTA!token级精准编辑,无需训练即插即用

北航团队在EMNLP 2025提出Token - Aware Editing (TAE)法,从token层面解决传统表征编辑技术问题,无需训练、即插即用,在多个对齐维度显著提升,如在TruthfulQA任务上真实指标提升25.8%。

量子位