推理算力」共找到 2724 篇相关文章

新闻资讯7

OpenAI推出GPT-5.1小小小小更新!!!

OpenAI推出GPT-5.1,本周向用户陆续推送,付费用户先行。它有两大核心模型,在遵循指令、推理回复及聊天体验上更佳。还有AMA问答活动披露更多细节,此外官方让自定义ChatGPT风格更易。

AI寒武纪
开源动态8

自回归科学基座模型 BigBang-Proton,提出实现 AGI 的新路线

超对称公司发布自回归科学基座模型 BigBang - Proton,挑战主流 AGI 技术路线。它实现多学科问题与 LLM 统一预训练和推理,有三项创新,在多专业任务表现出色,还提出宇宙尺度压缩构想。

AI科技大本营
新闻资讯8

具身智能一步踏入Scaling Law!10B+基础模型,27万小时真实数据

AI机器人创业公司Generalist推出新型具身基础模型GEN-0,参数量10B+,专为多模态训练构建。该模型展现强大Scaling Law,能力可扩展,有和谐推理等特性,在多方面有突破,成果备受赞誉。

机器之心
新闻资讯8

前OpenAI灵魂人物Jason Wei最新演讲!三大思路揭示2025年AI终极走向

前OpenAI核心研究员Jason Wei在斯坦福演讲,提出AI发展三大思路。他认为智能会商品化、成本下降,自适应算力出现;所有能被验证的任务最终会被AI解决;AI智能呈锯齿状,不会瞬间超越人类。

新智元
开源动态8

刚刚,Kimi开源新架构,开始押注线性注意力

智能体时代推理计算需求成瓶颈,线性注意力可降复杂度但表达有限。月之暗面开源 Kimi Linear 新架构,结合线性与全注意力,性能和硬件效率出色,引发对线性与全注意力发展方向的思考。

机器之心
推荐文章7

刚刚,Thinking Machines Lab博客提出在策略蒸馏,Qwen被cue 38次

Thinking Machines Lab发布《在策略蒸馏》博客,提出在策略蒸馏可结合强化学习纠错与SFT奖励密度,成本低且能让小模型有强大性能。该成果受Qwen团队启发,大量用Qwen3模型。还对比了不同训练方法。

机器之心
算法论文7

两招为GraphRAG图谱“提纯”,DEG-RAG效果有点炸~

文章指出传统RAG多跳推理和全局一致性能力受限,Graph - based RAG虽好但图谱噪音大。作者提出Deg - Rag方案,含实体消歧和关系反思两招。实验显示去噪后图谱效果提升,验证“Less is More”理念。

PaperAgent
开源动态8

AI点外卖哪家强,美团LongCat团队做了个全面评测

美团LongCat团队发布贴近生活场景的大模型智能体评测基准VitaBench,以三大高频生活场景为载体,构建含66个工具的评测环境。评测显示现有智能体与应用需求差距大,该基准已全面开源。

量子位
产品应用8

谷歌 DeepMind 推出 CodeMender:自动修复代码的智能代理

谷歌DeepMind推出CodeMender,这一AI驱动的智能代理能自动检测、修复并加固软件漏洞。它结合多种技术推理程序行为,生成修复方案经自动测试和人工审核后提交。社区反响积极,长期影响待察。

AI前线
新闻资讯7

哈佛CS博士月入4000,抢GPU搞科研!硅谷百万年薪挖人,学界疯狂逃离

AI人才大战使学术界陷入危机,博士生津贴低、抢显卡搞科研,面对硅谷百万年薪和大厂千亿算力投入诱惑,加速流向产业。教授担心学生跳槽,高校补救难,产业还推出“折中方案”,学术界考验才刚开始。

新智元