线性方向」共找到 855 篇相关文章

新闻资讯7

官宣!姚顺雨出任腾讯首席AI科学家,带队大语言模型、AI Infra

12月17日腾讯官方消息,腾讯升级大模型研发架构,新成立AI Infra部等。姚顺雨出任首席AI科学家,兼任AI Infra部、大语言模型部负责人,他在智能体方向成果多,论文总引用超1.9万。

机器之心
算法论文8

RL救不了泛化性!揭示LLM数学Reasoning的深层瓶颈

大型语言模型在数学竞赛级任务依赖机械化推理,现有评测集有缺陷。UC Berkeley团队提出OMEGA基准量化其数学泛化能力,实验揭示复杂度引发性能崩塌等问题,指出LLM创新组合难,给出改进方向

深度学习自然语言处理
开源动态8

阿里通义的视觉RAG革命!VRAG-RL:基于强化学习的视觉感知RAG框架,性能飙升30%

阿里巴巴通义实验室推出VRAG - RL,融合视觉感知、多模态推理与强化学习,已在GitHub开源。它破解传统RAG处理视觉数据难题,通过创新机制提升性能,在多数据集表现出色,还将向更拟人化和低幻觉方向发展。

开源星探
新闻资讯7

“机器人一次性卖完太亏!”真机智能刘智勇:今年中国本体厂商将大淘汰,拼的是世界模型?

InfoQ采访真机智能刘智勇,探讨具身智能领域进展、技术瓶颈及商业方向。刘智勇指出,VLN技术有进展但导航成功率待提升,世界模型可提升机器人能力,2026年本体厂商将收缩,盈利是核心。

InfoQ
推荐文章7

硅谷资深工程师:不止是 AI 产品,Coding 也需要好的 taste

硅谷资深工程师sean goedecke指出,技术品味与能力不同,其核心是为项目选适配工程价值观的能力。文章给出判断技术品味的方向,还阐述了好坏品味的识别方法及培养良好品味的建议。

Founder Park
新闻资讯7

GPT6来了,我却怀念GPT3.5

作者看到群里说ChatGPT等AI工具无法使用,意识到人们已离不开AI。接着提到GPT6发布,其各项测评指标比上一代大幅提升。还探讨了GPT6到来后SEO、GEO的意义及未来研究方向

白杨SEO优化教程
推荐文章8

为什么今天造大模型的人,一半在学物理

文章指出在AI前沿,不少定义方向的人出身物理。物理训练赋予的品味与做AI的方法论高度重合,体现在统计力学与神经网络、对普适规律的信仰等方面,还提到Scaling Laws最能体现这种品味。

五源资本 5Y Capital
算法论文8

多模态幻觉的病因「高熵节点」找到了!全基准幻觉率下降

多模态大推理模型的幻觉常出现在生成转折词时,此时模型处于高熵关键节点,易脱离图像证据。研究者提出LEAD,高熵时保留候选推理方向,注入视觉锚点拉回证据,实验显示它能跨领域提升模型性能。

新智元
新闻资讯7

GPT-5从零提出量子物理新想法,物理学家写成论文已登Physics Letters B

密歇根州立大学物理学家Stephen Hsu在《Physics Letters B》发表量子物理论文,核心思想由GPT - 5提出。论文探讨量子演化线性问题,推导出新算符可积性条件。他还分享与GPT - 5协作过程及体验,对人机协作前景乐观。

量子位
算法论文7

姚顺雨署名:大模型「现学现卖」能力首次被系统评估,腾讯、复旦联手发布CL-Bench

腾讯混元团队和复旦大学研究人员联手推出全新基准测试CL - Bench,系统性评估大模型上下文学习能力。测试显示十大前沿模型表现不佳,揭示当前大模型在该能力上的普遍短板,并指出未来四个探索方向

AI寒武纪