连续思维机」共找到 534 篇相关文章

新闻资讯7

堆推理链全错了!林俊旸离职首曝:曾在阿里 Qwen 踩中一个“致命”技术误区

阿里千问技术负责人林俊旸离职后发声,复盘 Qwen 训练尝试,指出合并 thinking 和 Instruct 模式不理想。他认为大模型未来应从‘推理思维’走向‘智能体思维’,并阐述了智能体思维的特点和挑战。

AI前线
算法论文8

刚刚,何恺明团队新作,「嵌入式语言流」ELF来了

何恺明团队提出ELF模型,将扩散过程置于连续向量空间,只在最后翻译成词。它用一个网络实现去噪和解码,引入自条件制。实验显示,ELF用不到其他方法十分之一数据,生成质量全面领先。

机器之心
算法论文8

RLHF与RLVR全都要,陈丹琦团队最新力作将推理能力拓展到通用智能

普林斯顿大学陈丹琦团队发布学术成果,提出基于模型奖励思维的强化学习(RLMT)方法,弥合专门推理与通用对话能力差距,将链式思维优势扩展到更广泛范围,提升整体对话表现。

机器之心
新闻资讯7

大模型是「躲在洞穴里」观察世界? 强化学习大佬「吹哨」提醒LLM致命缺点

加州大学伯克利分校副教授、强化学习大牛Sergey Levine在博客指出,当前大语言模型(LLM)只是对人类大脑和思维的间接「扫描」,如同被困洞穴看人类智慧「投影」,无法代替真正思维

机器之心
算法论文7

断网后才发现脑子空空?132页论文实证:「脑腐」或成AI头号内伤

新智元报道,独立研究人员Rénald Gesnot从多维度审视AI对人思维的重塑。研究指出多数人用AI时被「降智」,存在认知卸载、「过滤气泡」、被「洗脑」等问题,还提出前进方向。

新智元
算法论文8

清华联手英伟达打造扩散模型新蒸馏范式!视频生成提速50倍,4步出片不穿模

清华大学朱军教授团队与NVIDIA Deep Imagination研究组联合提出分数正则化连续时间一致性模型(rCM),将连续时间一致性蒸馏扩展至大模型,解决现有方法瓶颈,提升推理速度兼顾质量与多样性。

量子位
新闻资讯8

人形器人交付元年,行业从卷模型转向拼数据

2026年是具身智能交付元年,行业从卷模型转向拼数据。全球权威构重新定义“人形器人数据”地位,真数据是模型落地关键。乐聚等企业积极布局,通过训练场模式获取数据,解决行业痛点。

DeepTech深科技
推荐文章7

24小时快速入门大热语言Rust!学不会来找我

文章从Rust核心语法等基础入手,介绍其不同于其它语言的思维方式,还通过实战项目带读者入门。阐述了安装、工具使用,用greplite小程序介绍语言特点,讲解组织数据方式、所有权等,最后实现mini - redis并给出学习建议。

腾讯技术工程
算法论文8

Reasoning新突破:SoftCoT++如何让LLM‘多想几条路’?

LLM推理依赖‘思维链’,传统方法在离散token空间生成步骤有信息丢失、多样性不足问题。SoftCoT++在连续空间生成‘软思维’,拆分‘思考’与‘推理’,用专用初始token和对比学习,实验中全面超越传统方法。

深度学习自然语言处理
7

ASML,一夜崩盘?

全球光刻霸主ASML市值十个月蒸发超1300亿美元,原因有财报提前泄露、销售预期下调,还受美国出口管制、客户冷遇等影响。同时介绍其核心业务、市场地位,也提及中国光刻自主研发进展与挑战。

芯师爷