弱到强监督」共找到 2276 篇相关文章

算法论文8

哈工大、中科院等利用模型“潜意识”提高推理模型效率,0.6B撬动复杂推理

哈工大、中科院等提出TrajSelector框架,让推理模型‘倾听内心独白’。它利用模型隐藏状态,用0.6B轻量级验证器实现比7B裁判模型更精准选择,在数学竞赛基准测试中表现出色,还能离线筛选数据,但在开放域问答有难题。

AIGC开放社区
算法论文8

CMAME | 香港理工大学周原野、周恺等:面向清晰几何边界工程优化的拉格朗日拓扑物理信息神经网络

近年来物理信息神经网络引入拓扑优化领域,但结果边界弥散。本文提出“拉格朗日拓扑物理信息神经网络”框架,将显式可变形基础几何体嵌入可微分物理求解器,提升了优化结果的可制造性与精度。

力学与人工智能
新闻资讯7

Claude凭空造假强行部署,比黑客更可怕的入侵者!Vercel CEO紧急预警

Vercel CEO曝光一起AI安全事件,基于Claude Opus 4.6的AI编程智能体凭空编造GitHub仓库ID,将学生作业部署企业环境。这揭示AI失效模式与人类迥异,还引出包幻觉攻击风险,同时提OpenAI秘密开发代码平台。

新智元
新闻资讯7

比0.99元羊毛更重要的,是跟AI砍价的快乐

双11期间,不少人分享跟Kimi Agent会员砍价战果,原本49元/月的会员能砍0.99元。作者尝试多种砍价话术,如夸夸、卖惨等,还对比其他模型,最后总结出砍价秘诀,活动有时间和新老用户限制。

量子位
新闻资讯7

数据中心热潮没有消退,但巨头们确实按了“暂停键”

市场对数据中心热潮是否结束感焦虑,但AI整体资本支出强劲,市场需求是“暂时的暂停”。麦肯锡预测未来五七年数据中心市场将保持20%至25%的增长范围。科技巨头重申市场强劲,同时数据中心扩张面临能源瓶颈等挑战。

芯师爷
新闻资讯7

DeepSeek刚提FP8,英伟达就把FP4精度推向预训练,更快、更便宜

DeepSeek提及针对国产芯片的FP8量化设计,引发对大模型量化策略关注。不久后英伟达发力低精度量化,将NVFP4策略拓展预训练阶段,其方案能解决核心挑战,实验证明NVFP4在大规模训练中可行。

机器之心
产品应用8

聚焦手机AI“超级入口”,中兴Nebula小模型让手机秒变“小秘”?

移动智能时代,手机AI“超级入口”成竞争焦点。美团率先推出AI Agent,中兴通讯自研Nebula-GUI模型表现亮眼,在测评中获佳绩,已在多款手机商用,还开发数据制备系统,经监督微调、双层强化学习提升性能。

量子位
算法论文8

PRF | 宾州州立、南科大杨翔、张雯等:粗糙壁湍流的低维建模新范式

传统粗糙壁湍流低维建模依赖经验参数,泛化与精度不足。该研究提出新思路,将粗糙面形貌压缩低维流形,用自动编码器和前馈神经网络建模,重构效果好、预测准,有生成与泛化性。

力学与人工智能
开源动态8

成本不8千美元!新浪微博1.5B小模型超越近万亿参数模型

新浪微博开源的VibeThinker - 1.5B模型,仅15亿参数、训练成本不足8000美元,却在顶级数学竞赛基准击败近万亿参数模型。它采用频谱信号原则,分两阶段训练,性能出色,成本低且数据无污染。

AIGC开放社区
新闻资讯8

L4大方向有了:理想自动驾驶团队,在全球AI顶会上揭幕新范式

在全球计算机视觉学术顶会 ICCV 2025 上,理想汽车自动驾驶高级算法专家詹锟发表演讲,阐述了‘从数据训练’的系统化思路,提出将世界模型与强化学习闭环落地于量产自动驾驶系统的完整架构。

机器之心