跨任务自适应」共找到 2314 篇相关文章

算法论文8

刚刚,清华团队用27M参数击败o3-mini!或将改变AI发展方向

清华大学研究团队发布论文,展示Hierarchical Reasoning Model(HRM)。该模型仅27M参数、1000个训练样本,在推理任务上击败OpenAI的o3 - mini - high,或改变AI发展方向。

AGI Hunt
算法论文8

ScreenCoder:视觉-代码对齐新范式,为多模态程序合成开辟道路

前端开发中UI转代码耗时易错,现有工具存在不足。ScreenCoder提出模块化多智能体框架,通过三阶段分工协作实现代码生成,还构建数据引擎推动VLMs进化,实验表现出色,为多模态程序合成开辟道路。

深度学习自然语言处理
开源动态8

The Batch: 855 | 为智能体而生

总部位于北京的 Moonshot AI 发布 1 万亿参数的 Kimi K2 系列大语言模型,包括预训练和微调版本。它输入输出能力强,架构独特,在多基准测试领先,支持工具调用,多家服务商已集成。

DeeplearningAI
推荐文章8

Claude code:下一个千亿级软件市场的蓝图

LATE CHECKOUT CEO认为Claude Code将带来软件行业变革,它驯服终端,让自然交互成趋势,会催生新机遇和超级用户,未来软件易用性价值更高,技术将适应人类语言。

AI寒武纪
新闻资讯7

人类下一个奇点,超级智能时代

OpenAI联合创始人Sam Altman在博客《温和的奇点》中表示,人类已越过技术转折点,迈向数字超级智能时代。他预测2025 - 2027年将有系列智能成果出现,到2030年代智力和能源将丰富,虽有挑战但前景乐观。

AIGC开放社区
推荐文章7

Anthropic的多智能体,真的有必要吗?

作者曾质疑多智能体系统,看了Anthropic对「Claude Research」的说明后有了改观。介绍了多智能体系统定义、性能提升、代价,还阐述构建方法、评估方式,公开三个核心提示词及协作模式。

AGI Hunt
开源动态7

从browser-use 出发,品 Agent 实现

本文作者以学习总结视角,从browser - use出发解析Agent实现。介绍LLM不同阶段,阐述Agent记忆、规划、工具等要素,通过对话演示和源码分析展示运行机制,还探讨MCP集成和Coze space应用模式。

阿里云开发者
算法论文8

首次解释LLM如何推理反思!西北大学谷歌新框架:引入贝叶斯自适应强化学习,数学推理全面提升

西北大学与Google、谷歌DeepMind团队质疑传统强化学习与反思的关系,提出贝叶斯自适应强化学习方法,首次解释为何、如何及何时反思探索新策略,还给出决策数学形式,实验显示其性能更优。

量子位
开源动态7

Alibaba开源WebDancer解决DeepResearch复杂信息检索难题

Alibaba开源WebDancer,从数据和训练阶段出发提出端到端自主信息检索代理构建范式。实验中,它在GAIA和WebWalkerQA基准测试表现出色,处理复杂信息检索优势显著。

CourseAI
推荐文章8

两年内打造AI软件工程师!OpenAI Codex 作者解密人机结对编程新模式

AI科技大本营编译访谈,OpenAI的Josh Ma与Alexander Embiricos分享Codex项目,包括缘起、人与AI结对编程范式,还探讨产品形态、最佳实践等,预测两年内打造智能体软件工程师。

AI科技大本营