AI算力大会」共找到 12227 篇相关文章

产品应用8

三星研究院发布手机端侧模型MeKi:基于Memory的LLM扩展新范式,支持旗舰手机端侧部署

三星研究院发布端侧模型架构MeKi,提出用存储空间扩展模型容量、提升LLM性能的新范式。它利用手机ROM缓解内存压力,实现容量与性能提升。实验显示其性能、效率表现优,为边缘部署LLM提供新思路。

AI科技评论
算法论文8

LLM内部竟藏着众多策略模型?自所&腾讯团队首次揭示模型RL新机制

中国科学院自动化研究所与腾讯AI Lab团队,从可解释性分析出发,发现LLM内部含多个可采样内部策略,揭示不同模型推理熵模式,提出BuPO算法,在复杂推理任务上表现优于传统算法。

PaperAgent
新闻资讯8

马斯克还在卷10秒,中国AI直接掀桌!16秒一镜到底,全球唯二

2026年AI视频圈竞争激烈,硅谷巨头激战正酣,马斯克Grok Imagine上线生成10s视频功能。在此背景下,中国AI的Vidu Q3登场,16s音画直出一镜到底,还支持多种功能,位列中国第一、全球第二。

新智元
产品应用7

不再迷信Hackathon,把Agent推翻重做了4次!Notion负责人复盘:做AI产品如何避免“逆流而上”?

Notion负责人复盘Agent开发历程,指出AI替代的是流程。他们将模型、产品和权限接入同一框架,历经多次重构,还探讨了组织管理、评估体系、软件工厂等内容,分享对CLI和MCP的看法及产品定价策略。

AI科技大本营
算法论文8

复旦、同济和港中文等重磅发布:强化学习在语言模型全周期的全面综述

来自多所顶尖科研机构的研究者完成长文综述,总结语言模型全生命周期的强化学习研究,阐述其各阶段应用策略,分析未来挑战与趋势,重点关注 RLVR 技术,有全生命周期梳理等三贡献。

机器之心
算法论文8

字节&MAP重塑模型推理算法优化重点,强化学习重在高效探索助力LLM提升上限

强化学习虽提升语言模型表现,但面临探索难题。字节跳动等团队提出FR3E框架,分两阶段重建探索机制,在多数学推理基准实验中显著优于强基线,为模型强化学习提供新范式。

量子位
新闻资讯8

AI Agent、RLHF 到 MoE 规模训练:AMD 这场开发者日,把一线实战话题凑齐了 |Q推荐

AMD AI开发者日揭晓八硬核GPU Workshop、技术专题及“作品说话”主题分论坛嘉宾与话题,覆盖AI Agent、RLHF、MoE规模训练等前沿领域,还有多场实操分享。

InfoQ
算法论文8

联手通义实验室发布ZeroSearch:成本暴降88%,无需搜索即可激活语言模型的检索能力!

与通义实验室发布ZeroSearch框架,可无需真实搜索激活语言模型检索能力。它引入语言模型模拟搜索、采用结构化模板等策略,成本降88%,多项实验显示其性能超越基线与真实搜索方法。

深度学习自然语言处理
算法论文8

ACL'25最佳论文解读 | 模型也会‘弹簧回弹’?揭秘 LLM 对齐的脆弱根源

本文分享 ACL 2025 最佳论文,指出预训练模型存在‘抗对齐’的 Elasticity 现象,即对齐微调只是暂时拉伸,后续微调会让其迅速弹回预训练分布。研究量化该概念,用‘压缩理论’刻画对齐并实验验证。

PaperAgent
产品应用8

揭秘夸克首个高考志愿模型!蒸馏数百名人类专家经验、Agent 可完整生成志愿报告

6月12日,夸克发布国内首个高考志愿模型,上线‘高考深度搜索’等三核心功能。其‘志愿报告’以Agent运行,能输出完整报告;模型经多阶段训练,搭载最高考知识库,为考生提供精准志愿填报服务。

AI科技大本营