思考Agent模型」共找到 9627 篇相关文章

算法论文8

牛津、NUS提出下一代世界模型方向:心智世界模型来了

牛津大学和新加坡国立大学研究团队提出心智世界建模(MWM)通用框架,将心智变量纳入世界状态。还实现基准系统 MENTIS 验证其有效性,实验表明 MWM 对预测人类决策必要,瓶颈是状态转移模拟能力不足。

机器之心
开源动态7

Kimi K2基于DeepSeek V3构建

从Hugging Face模型配置文件可知,月之暗面未设计全新模型结构,而是选Deepseek V3作基座模型,用自身高质量数据、独特方法做大量‘微调’和‘后训练’。

AI寒武纪
7

Atlas退场:OpenAI放弃的不是浏览器

OpenAI宣布放弃浏览器Atlas,它将被内置到ChatGPT和Codex里。如今‘Agent first’成共识,浏览器是Agent能力体系组件,非入口,独立AI浏览器可能方向错误。

AI产品黄叔
算法论文8

天文预测新SOTA!紫东太初&国家天文台联手攻克恒星耀发难题

紫东太初与中国科学院国家天文台联合开发天文耀发预测大模型FLARE,能精准预测恒星耀发事件。该模型整合恒星物理属性和历史耀发记录,提升预测准确性,相关论文被IJCAI 2025录用。

量子位
算法论文8

生成视频总出物理bug?用VLM迁移+token级对齐,让燃烧在正确位置发生,碰撞遵循动量守恒丨CVPR 2026近满分接收

现有生成式视频模型多停留在“外观拟合”,未真正“物理建模”。中山大学等机构提出ProPhy,构建渐进式物理对齐框架,使模型有“分层物理理解”与“空间物理对齐”能力,论文被CVPR2026近满分接收。

量子位
产品应用8

The Batch:827 | Claude 4 推动代码生成能力再升级

Anthropic 发布 Claude 4 Sonnet 和 Claude 4 Opus 模型,支持“推理模式”,能并行调用工具。还发布 Claude Code 编程智能体及 SDK。两款模型输入输出能力强,功能亮点多,性能表现佳,有多种使用渠道和定价。

DeeplearningAI
新闻资讯7

两岁的Llama,最初的14位作者已跑了11个!Mistral成最大赢家

Meta 开源 Llama 模型改变大模型格局,但短短两年,14 位初创作者 11 人离职。Mistral 受益最大,由两位核心架构师创立,其模型与 Meta 竞争。Meta 面临留才挑战,领先优势消退。

机器之心
开源动态8

最强开源VLM“华山论剑”丨多模态专场直播

近期Intern - S1等多模态大模型开源,引发热烈讨论。本周四OpenMMLab等发起AI Insight多模态专场,邀请模型核心研发者分享,涵盖模型设计思路、实践经验等,还有圆桌对谈。

OpenMMLab
新闻资讯7

Cloudflare 构建了面向 LLM 的高性能基础设施

Cloudflare发布全新基础设施,可在全球边缘网络运行大型AI大语言模型。它将模型输入处理与输出生成拆分,自研Infire推理引擎,还推出Unweight模型压缩系统,分享提示词缓存优化方案。

InfoQ
新闻资讯7

在 OpenClaw 的冲击下,Cursor 已经要过时了

Insight Partners 联合创始人 Jerry Murdock 接受访谈,认为自主 Agent 是 AI 浪潮核心,Cursor 已过时。还提到会有自主 Agent 专属技术栈,软件未来将由 Agent 购买,劳动力市场会受冲击,现在是创办新基金的最佳时机。

Founder Park