「大模型架构」共找到 10017 篇相关文章

算法论文8

首次解释LLM如何推理反思!西北大学谷歌新框架:引入贝叶斯自适应强化学习,数学推理全面提升

西北大学与Google、谷歌DeepMind团队质疑传统强化学习与反思的关系,提出贝叶斯自适应强化学习方法,首次解释为何、如何及何时反思探索新策略,还给出决策数学形式,实验显示其性能更优。

量子位
开源动态8

白嫖10余家AI服务,一个接口全搞定,爽了!

现在主流AI厂商虽有免费额度,但使用起来接口、SDK、限流规则等差异大,适配麻烦。freellmapi项目将Google Gemini等十几家AI平台免费Tier聚合,对外一个接口,自动调度、切换和限速,适合做AI原型开发等。

开源先锋
新闻资讯8

LeCun和哈萨比斯「吵」起来了:「通用智能」到底存不存在?

LeCun 在播客称「通用智能」不存在,引发广泛讨论。Google DeepMind 掌门人 Hassabis 引用该帖硬刚,认为人类大脑和 AI 基础模型近似图灵机,有通用性。LeCun 回应强调这是数学事实,双方分歧反映对 AGI 发展路径的不同判断。

机器之心
推荐文章7

Ropedia刘子纬:具身智能的Scaling Law,不是算力,是人类的经验

Ropedia刘子纬指出,当前物理AI面临差距,下一阶段需Scaling人类物理世界的经验。Ropedia构建真实世界经验引擎,形成经验飞轮,目标是打造能看见、记住、想象并行动的模型。

Founder Park
开源动态8

Specula在67个开源系统中找到382个深层bug,数月形式化验证缩短到几小时

截至2026年8月19日,Specula已在67个开源系统找出382个bug。它让coding agent自动生成TLA + 模型和正确性不变量,运行检查并复现问题,将数月的形式化验证缩短到几小时,降低了形式化方法使用门槛。

机器之心
推荐文章7

2026年必须搞懂的20个 Agent 工程概念(运行机制篇):大白话一次讲清。

文章聚焦Agent工程运行机制,介绍20个核心概念。如Agent与ChatBot区别在于会‘做’;Harness是模型运行框架;Execution Model决定思考行动范式等,还给出各概念工程实践建议。

AI大模型应用实践
8

OpenAI祭出GPT-5.4神装!Codex同款Harness全面开放

OpenAI重写Agents SDK架构,将其从‘聊天机器人玩具’变为‘生产级Agent底座’,原生收编七大沙盒,还把Codex经验产品化塞进SDK,这冲击了第三方框架,也让沙盒供应商纳入其生态。

新智元
算法论文8

不止修bug:Agentic Coding评测走向复杂feature交付新阶段

中国科学院自动化研究所联合华为提出 FeatureBench,构建端到端基础设施并开源。它从单元测试出发构造评测任务,引入多种机制保障任务可执行、可验证,能有效区分模型能力,还提供易用的评测流程。

机器之心
新闻资讯7

劈柴哥玩得上头!Nano Banana Pro 真杀疯了,但谷歌没接住用户的付费热情?

谷歌推出新图像生成与编辑模型 Nano Banana Pro,它基于 Gemini 3 Pro,能力提升,获大量好评。不过付费流程繁琐遭吐槽。此外,谷歌 CEO 回应了 AI 泡沫、岗位影响等问题。

AI前线
推荐文章7

破立之间:智驾芯片博弈的“新赛道”

全球汽车产业向智能化转型,智驾芯片成产业链核心。当前产业面临多重困境,国际巨头垄断高端市场,行业陷入“算力堆砌”。SDSoW技术是破局之道,有三大特征,能实现性能、能效等多方面提升。

芯师爷