多阶段训练」共找到 5975 篇相关文章

算法论文8

ICLR 2026 | 7B小模型干翻GPT-5?AdaResoner实现Agentic Vision的主动「视觉工具思考」

文章介绍了AdaResoner模型,它学会‘何时用工具’,在拼图推理上击败GPT - 5。Google为Gemini 3 Flash引入‘Agentic Vision’,与AdaResoner殊途同归。AdaResoner有独特训练方法,提升小模型性能。

机器之心
开源动态7

推出 AnyLanguageModel:在 Apple 平台统一本地与远程大语言模型的 API

大语言模型是构建现代软件的重要工具,但 Apple 平台开发者集成模型困难。Hugging Face 发布 AnyLanguageModel,是 Swift 包,可替代 Apple Foundation Models 框架,支持模型服务商,降低使用 LLM 难度。

Hugging Face
新闻资讯8

菲尔兹奖得主:AI现在主要靠「抬杠」突破重大数学猜想

1998年菲尔兹奖得主Gowers发现,最近AI在数学界的轰动突破,如雅可比猜想、Erdős单位距离猜想等,靠“找反例”实现。他指出AI热衷此,因知道得且试得起,但目前缺“嗅觉”。

量子位
算法论文8

桌面 Agent 的下一步:不是会操作,而是会调度工具

复旦大学和通义实验室提出 ToolCUA,让模型在 GUI 与工具调用间编排路径。它从已有 GUI 轨迹合成训练数据,设计奖励机制,在 OSWorld - MCP 评测中效率与准确率大幅提升,为 CUA 发展提供方向。

深度学习自然语言处理
推荐文章7

盘一下Anthropic 244页Claude Mythos报告中隐藏的SAE技术

Anthropic公布强大危险的大模型Claude Mythos Preview但未发布。文章深挖其244页报告中SAE技术细节,包括前期探索、技术框架、训练监控、攻击性行为分析及掩盖行为等,助了解模型内部思维。

PaperAgent
产品应用8

告别单打独斗!ClawTeam-OpenClaw 一键 spawn 整个 AI 开发团队

ClawTeam-OpenClaw 是代理协调框架 OpenClaw 深度适配版,让 AI 代理自动组队协作。它有一键 spawn 团队、智能任务依赖管理等功能,在科研、开发、投资分析场景优势明显,介绍了使用方法和项目地址。

小华同学ai
推荐文章7

Sutton 的批评与反思:AGI 的下一步是什么?

文章是对 Richard Sutton 采访的反思,指出 LLM 训练效率低、依赖人类数据,未实现有机自主学习。作者与 Sutton 有分歧,认为模仿学习与强化学习互补,还探讨持续学习,称 Sutton 批评有启发性。

AGI Hunt
开源动态7

自动生成 AI 领域 Reddit 趋势报告

该项目可自动从Reddit AI相关社区生成双语趋势报告。具备实时监控、社区分析等功能,有详细趋势分析。介绍了安装设置、使用方法、创建仓库、自定义配置等内容,助用户掌握AI领域发展。

GitHubStore
新闻资讯7

孙正义要用10亿个智能体干掉所有程序员

软银创始人孙正义宣布集团迈入‘人类程序员时代的终结阶段’,计划让AI智能体全面接管编码和编程工作。今年将部署首批10亿个AI智能体,未来会有数万亿个投入使用,且成本低廉。

AGI Hunt
新闻资讯7

性能翻番背后:讯飞与昇腾,如何用国产算力炼就大模型?|甲子光年

在全球AI竞争激烈背景下,科大讯飞与华为昇腾深度合作意义重大。双方合作历经四阶段,实现性能提升与技术突破,还通过软硬件协同构建AI自主发展竞争力,加速大模型行业落地。

甲子光年