港科大(广州)」共找到 5120 篇相关文章

算法论文7

DeepSeek的GRPO会导致模型崩溃?看下Qwen3新范式GSPO

文章围绕语言模型后训练阶段的强化学习算法展开。介绍了OpenAI的RLHF、DeepSeek的GRPO,重点指出Qwen团队发现GRPO有稳定性问题,会致模型崩溃,进而提出新算法GSPO,实验显示其效率和可扩展性更佳。

机器之心
算法论文8

无需标注和奖励模型!仅靠自信度RL,16个样本训练20步,效果飙升21%!

论文提出RLSC,让语言模型用自身答案置信度作奖励信号,摆脱人类标注依赖。它以模型自信度内部信号替代多数投票外部信号,小成本提升模型数学能力,还让模型学会快推理,不过也存在安全隐忧。

深度学习自然语言处理
算法论文8

RAG搜对了却答错?德国萨尔学找到了真相丨ACL'26

RAG已成模型落地标配技术,但存在搜到对的文档、模型答案却离谱的痛点。德国萨尔学等组成的团队诊断出问题在阅读理解,提出Disco - RAG框架,在“搜”和“答”间加“读懂”环节,已被ACL 2026主会录用。

量子位
新闻资讯7

硅谷今夜学中文!Cursor被曝「套壳」国产,AI顶级人才全是华人

新智元报道,硅谷AI圈现神奇现象,不会中文难进核心团队。海外模型频“偷师”国内开源模型,如Cursor的Composer思考时说中文,Windsurf用GLM-4.6微调。国内开源模型量管饱、性能好还便宜,能力稳居第一梯队。

新智元
开源动态7

4万星开源项目被指造假!MemGPT作者开撕Mem0:为营销随便造数据,净搞没有意义的测试!

高人气开源智能体记忆项目Mem0在论文中称在LOCOMO上打败所有人,MemGPT联合创始人公开指控其测试无意义、数据造假。二者都为解决模型长期记忆问题,Letta认为能力比工具重要,并给出评估智能体记忆能力的方法。

AI前线
产品应用8

WAIC现场最“聪明”展台!AI眼睛耳朵能力全打开了

WAIC现场,声网展台被观众挤爆,其新奇“AI玩具”都能与玩家流畅对话。声网对话式AI引擎全新升级,新增选择性注意力锁定、视觉理解能力,能与主流数字人方案集成,还可接入模型,价格低。它已在多领域落地。

量子位
新闻资讯8

国产AI高考708分,这款模型靠什么成为「屏蔽生」?

高考放榜,媒体对国内外模型进行测试。综合成绩上,讯飞星火X2物理、历史类表现优异;单科专项中,它在数学、作文等测试也领先。其优势源于数据积累、理解评判标准,还采取软硬件一体化落地路径。

机器之心
新闻资讯7

智能流体力学青年学者论坛第28讲:伦敦城市学Manolis Gavaises教授

智能流体力学青年学者论坛第28讲于2025年12月4日9点至12点在航空楼A110举办。多位学者分享成果,如Manolis Gavaises用机器学习建模多相流;方波李研究超临界流体湍流;陈杰石提出涡模拟子网格模型等。

力学与人工智能
新闻资讯7

硅谷爆发反AI「起义」!程序员拒用Cursor被一周解雇

AI席卷职场,厂裁员与岗位替代加速。奥特曼称能被AI取代的工作并非「真工作」。硅谷上演「代码战争」,有人拥抱Cursor/Claude提效,有人拒用AI遭解雇,人类价值与工作定义正被重写。

新智元
推荐文章7

AI 原生应用全栈可观测实践:以 DeepSeek 对话机器人为例

本文以 DeepSeek 对话机器人为例,介绍 AI 原生应用架构可观测需求、挑战与方案实践。分析 AI 领域痛点,提出阿里云 AI 全栈可观测架构,剖析模型应用可观测技术,分享实战案例,还给出未来规划。

InfoQ