大规模数据」共找到 6872 篇相关文章

算法论文8

ICML 2026 | 模型为什么算不对加法?南团队提出等本位和轨迹,揭示LLM算术错误的几何机制

团队研究LLM在多操作数加法中的内部表征结构,发现算术状态呈高度结构化几何流形。提出等本位和轨迹与噪声量化模型,解释模型算错加法原因,还设计推理时纠错方法。

机器之心
算法论文8

都在卷「让模型多循环几遍」,这个7B模型LoopCoder v2说:多循环 1 次就够了

当下推理模型流行在测试时多循环,以打磨答案。但新研究发现,7B模型LoopCoder v2只多循环1次(共2次),就能幅提升性能,继续增加循环次数,性能反而下降。研究还分析了收益与成本,给出选择循环次数的诊断方法。

机器之心
算法论文8

监督学习未死,一题训练五小时起飞!华人学者新方法20倍训练效率释放模型推理能力

模型推理能力研究中,RL训练资源成本高、不稳定,传统SFT低数据量易过拟合。加拿滑铁卢学华人团队提出One - Shot CFT方法,用一题多解多点评训练,仅需约5个GPU小时,效果好、稳定性强。

量子位
产品应用7

数字技术工人已到岗!时序模型+Agent已掌握了工厂生产管控技术,比人类更懂工况

基于时序模型和Agent的数字技术工人,能承担生产操作等关键任务,接手复杂工业环节。国内AI团队打造的河谷平台构建智能体,自研底层技术,以工艺维度训练,上岗快,极峰科技还创新商业模式。

量子位
新闻资讯7

AI顶会反噬整个学术圈!「不发表就会死」,NeurIPS爆仓,博士年肝4.5篇崩溃

NUS研究者指出,NeurIPS等AI顶会投稿量激增,正反噬学术圈。当前模式存在结构性危机,如学术产出泡沫化、环境代价高、研究者心理负荷等。为此,他们提出“社区联邦会议”(CFC)模型以解决问题。

新智元
算法论文8

该工作引来马斯克回复,让Gork破防:CoT是真正的推理,还是训练数据的统计插值?

型语言模型(LLMs)的思维链(CoT)推理能力被视为突破性进展,但论文揭示CoT可能只是数据分布内的模式匹配幻象,通过实验证明其在分布偏移时表现急剧退化,挑战主流认知。

深度学习自然语言处理
推荐文章8

模型开发实战从入门到入坑:动手写一个MCP Server去理解MCP背后的技术原理

文章聚焦MCP协议,介绍其是规范应用向模型提供上下文的开放协议,能让模型调用接口更简单、实现开发解耦。还深度解析技术原理,手把手教从0到1实现MCP Server,助读者理解背后技术。

阿里云开发者
开源动态8

社区供稿丨迈向AI4S 2.0,上海AI实验室开源书生万亿科学模型Intern-S1-Pro

2月4日,上海人工智能实验室开源万亿参数科学多模态模型Intern - S1 - Pro,为AI4S迈向2.0时代提供开源基座。其核心能力跃升,架构创新,协同通用与科学能力,还构建‘算力 - 算法’基座,高质量开源赋能生态。

Hugging Face
开源动态8

核心创新公开,快手开源多模态Keye-VL 1.5拿下视频理解SOTA,8B力压GPT-4o!

快手开源多模态Keye-VL 1.5,为8B视频理解最强模型,公开3核心创新技术。它靠Slow-Fast视频编码等,在20+基准屠榜。在多类基准测试和内部测评中表现优异,将业务经验沉淀到开源社区。

PaperAgent
算法论文8

RL 将如何提高具身模型 VLA 泛化性?清华学团队NeurIPS 2025文章分析 RL 与 SFT 泛化性差异

清华学团队在NeurIPS 2025发表文章,揭示强化学习(RL)提升具身模型VLA泛化能力的优势,对比其与SFT差异,还提出评测基准和训练方法,为VLA训练提供新方向。

机器之心