大厂推虾苗」共找到 5497 篇相关文章

算法论文8

喂给AI的Skill正让它变笨!清华团队发现模型经验复用的黄金法则

清华学与EvoMap团队研究发现,给模型提供详尽纠错Skill会使基准测试通过率下跌,而精简控制指令可提升性能。他们提出将程序化Skill转化为策略基因,经实验证实其更适合驱动智能体测试时演化。

AIGC开放社区
新闻资讯8

模型收入暴涨1076%,港股AGI第一股首份年报:一年狂揽12亿,属实把商业化玩明白了

港股AGI第一股云知声披露首份年报,全年营收12亿,模型业务收入暴涨1076%成核心增长引擎。其靠“强基模、深应用”战略实现业绩增长,还计划拓展MaaS模式,探索多元“第二曲线”。

量子位
算法论文7

MoE RL 实战:统一 FP8 全流程训练

SGLang RL 团队等实现 RL 全流程 FP8 训练与采样,消除训不一致性。介绍 FP8 硬件基础、格式等,分析训练难点,定位 KL Loss 异常源于量化原理,验证其在 MoE 模型 RL 场景优势,指出模型规模与训不一致的关联。

GiantPandaLLM
算法论文8

Shopee OnePiece:业内首个融合上下文工程、隐式理和多目标训练策略的生成式搜建模框架

2025年生成式荐发展火热,但工业界落地多在序列化建模,替换传统范式遇阻。Shopee傅聪团队联合人高瓴学院提出OnePiece范式,是业内首个融合多策略的生成式搜建模框架,含上下文工程、隐式理和多目标训练策略。

InfoQ
开源动态7

国内首套:港中文团队发布7模态人体动作数据集,揭开模型理解能力短板

港中文邢国良教授团队博士生蒋思阳完成 CUHK-X 多模态人体动作数据集,成果被 ACM MobiSys 2026 接收。用其测试主流模型,发现理解人类动作平均正确率仅四成。该数据集数据收集方法反常规,还开展了基准测试。

DeepTech深科技
开源动态8

全能高手&科学明星,上海AI实验室开源发布『书生』科学多模态模型Intern-S1 | WAIC 2025

7月26日,上海AI实验室在WAIC 2025上发布并开源『书生』科学多模态模型Intern-S1。它首创‘跨模态科学解析引擎’,在多学科专业任务上超越顶尖闭源模型,多模态综合能力领先主流开源模型。

OpenMMLab
算法论文8

Qwen&清华团队颠覆常识:模型强化学习仅用20%关键token,比用全部token训练还好

Qwen与清华LeapLab团队研究发现,模型强化学习训练理能力时,仅20%高熵token就能撑起效果,甚至超全部token训练。团队用此在Qwen3-32B创造新SOTA记录,还探讨了强化学习的相关特性。

量子位
算法论文8

告别高昂重制成本!港科广州、快手可灵发布立体视频转换单步理新方案

随着 3D 设备发展,人们对 3D 立体视频需求增加,但高昂制作成本成阻碍。快手可灵与港科广州团队联合提出 StereoPilot 模型,能快速将 2D 视频转为高质量 3D 视频,还构建了 UniStereo 数据集。

机器之心
开源动态7

一周斩获8k星!港开源AI学习助手,学练研全流程覆盖,教师也要失业了?

开源的DeepTutor是AI个性化学习助手,利用多智能体协作等技术,有文档问答、难题解析等四核心功能,能构建专属知识库,提供全流程辅导,为学、练、研打造一体化平台。

开源AI项目落地
新闻资讯7

模型低价趋势延续!智象未来姚霆:B端、C端界限模糊,API不够、逼出 “按结果付费”

InfoQ 采访智象未来联合创始人姚霆,探讨多模态模型发展。他指出深度 Scaling up 收益放缓,广度 Scaling up 有惊喜;2025 年模型价格战倒逼商加速,低价趋势 2026 年将延续,商业模式转向“按结果付费”。

InfoQ