可验证推理」共找到 6064 篇相关文章

开源动态8

SGLang原生支持昇腾,新模型一键拉起无需改代码

12月20日SGLang AI金融π对收官,聚焦大模型推理效率。昇腾成SGLang原生支持后端,助DeepSeek等模型免调参运行。SGLang给出推理系统工程解法,昇腾与SGLang深度共建,性能优且全面拥抱开源。

量子位
开源动态7

直播预约 | LightMem:面向大模型的轻量化插拔记忆系统

本报告聚焦大语言模型长期记忆构建与轻量化机制。现有外部记忆系统有记忆臃肿、组织低效、更新代价高问题。为此提出LightMem架构,能为大模型提供轻量、高效、扩展记忆组件。

深度学习自然语言处理
新闻资讯7

山姆•奥特曼刚发长文:《丰盛的智能》,智能将人人

Sam Altman 发布新博文《Abundant Intelligence》,展现 OpenAI 的 AI 基础设施愿景。他认为获取 AI 将成经济驱动力甚至基本人权,还提出每周产一吉瓦 AI 基础设施工厂的计划,称增加算力是增收关键。

AGI Hunt
算法论文8

ACL 2026 | 赋予视频生成「视觉思维链」:VChain显式建模时空规划与状态演变

南洋理工大学团队在ACL 2026发表VChain框架,引入大模型视觉推理能力提升视频逻辑连贯性。它分三步实现,实验效果超现有方法,还展示视频推理与生成的潜在趋势,为多模态模型协作提供范例。

机器之心
产品应用8

马斯克视频生成模型首次交卷!电影级运镜+音效,免费

xAI的“迄今为止最强大的视频音频生成模型”Grok Imagine 1.0正式全面上线。该模型支持文生视频、图生视频,音频效果出色,还擅长日常趣味创作。其在视频生成和剪辑性能领先,官网免费玩。

量子位
产品应用8

美团之后,京东也开始自研大模型了

京东发布JoyAI - LLM Flash模型,激活参数小、推理快。它采用混合专家架构等技术,在基础架构、数据加工、强化学习等方面表现出色,还通过多Token预测等技术加速推理,为商业场景落地扫清障碍。

AIGC开放社区
算法论文8

斯坦福7B智能体全面超越GPT-4o,推理流登顶HF

传统智能体系统难兼顾稳定性和学习能力,斯坦福等团队提出AgentFlow框架,通过模块化和实时强化学习优化策略,使7B参数模型在多任务上超越GPT - 4o等大模型,为AI发展提供新思路。

新智元
算法论文8

只要9美元!LoRA+强化学习,DeepSeek 1.5B推理性能暴涨20%

南加州大学团队基于LoRA的强化学习训练1.5B推理模型,在AIME 24测试上性能提升超20%,成本仅9美元。开源Tina模型结合三大关键技术,与SOTA模型相比竞争力强,研究者还对其有效性提出假设。

新智元
开源动态8

Hugging Face开源nanoVLM,750行代码训练视觉语言模型,简单到令人发指!

Hugging Face开源全新视觉语言模型框架nanoVLM,仅750行代码就能从零训练高效能VLM模型。它在单张H100 GPU训练6小时后,在MMStar数据集准确率达35.3%,且能在免费Google Colab跑。

AGI Hunt
算法论文7

60个量子比特顶百万倍内存:量子机器学习找到新的突破口

4月8日,加州理工学院等联合团队在arXiv发布论文,证明小型量子计算机处理部分机器学习任务时,用指数级更少内存超越经典计算机。研究绕开QRAM,提出算法框架验证优势,但仍待真实硬件验证

DeepTech深科技