多任务能力」共找到 7307 篇相关文章

算法论文8

ACL 2026 | Spatial-Agent:地图Agent全新概念转换范式

论文 'Spatial-Agent' 提出地理空间问答应建模为 'concept transformation',引入 GeoFlow Graph 中间表示。它从自然语言问题构建图结构,再映射到工具调用。实验显示其对地图任务有帮助,还指出构建地图类 agent 需稳定数据源等。

PaperAgent
算法论文8

RL特训出「押题大师」?破解模型微调中的样性危机与灾难性遗忘

近年来,基于可验证奖励的强化学习(RLVR)成为提升大语言模型推理能力的重要路径,但许经RL微调的模型出现‘越训越单一’问题。复旦大学等团队聚焦长期被忽视的KL散度项,提出DPH - RL方法,可缓解样性坍塌。

新智元
新闻资讯7

推理之父走了!OpenAI七年元老离职:有些研究这里没法做

新年伊始,OpenAI研发副总裁Jerry Tworek离职,他是编程和两大核心技术路线奠基者,攻克LLM编程和复杂推理商业化难题。他称想探索在OpenAI难开展的研究。此前已有位核心人才出走,OpenAI或因商业化与安全问题留不住人。

新智元
开源动态8

混元开源PhoneBuddy-4B与5篇系列论文:项手机Agent真机评测超过GPT-5.4

腾讯混元Phone - use Agent团队发布PhoneBuddy - 4B及5篇系列论文。研究探讨如何训练真实可用的Phone - use Agent,采用Real + Mock方式,实验显示该方法提升效果显著,4B模型任务超GPT - 5.4。

量子位
产品应用7

安卓开发被Vibe Coding接管了?谷歌把搓App门槛彻底打下来,一周搓出25万个

谷歌近期状况不佳,不过 Google AI Studio 上线免费生成原生 Android App 功能挽回颜面。上线一周创建超 25 万个 App,99% 以上用户此前未做过安卓开发,无需代码就能开发,还支持 Remix。实测显示效果不错。

机器之心
开源动态8

社区供稿丨35B参数科学性能比肩万亿参数模型,『书生』科学大模型Intern-S2-Preview开源

5月15日,上海AI实验室开源新一代大模型预览版Intern - S2 - Preview,参数35B,领域比肩万亿参数模型。它深化与昇腾算力生态协同,探索‘通专融合’,强化科学及智能体能力,‘算法 - 系统 - 算力’协同提升训推效率。

Hugging Face
开源动态8

参数砍到 1B,这个小钢炮拿下模态第一

面壁智能发布并开源参数量仅 1.3B 的 MiniCPM-V 4.6,虽小但模态综合能力在 1B 级别中夺冠。它推理快,效率高,靠两大架构创新实现,还为开发者提供完整工具链。

AGI Hunt
产品应用7

The Batch: 954 | Kimi K2.6 挑战开源权重模型领先者

Moonshot AI升级后的Kimi K2.6是1万亿参数的视觉 - 语言模型,专为代码生成设计,性能与Qwen3.6 Max Preview等相当,略逊顶级闭源模型。其功能,幻觉率低,模型权重可免费下载。

DeeplearningAI
算法论文8

AST | 西工大崔榕峰、张伟伟等:基于物理约束与双并行注意力UNet++的高保真度三维机翼流场重构研究

本文针对三维机翼流场重构难题,提出DPAtt - UNet++框架,融合几何隐式编码、尺度注意力与物理规律约束。实验表明,其重构精度高,预测速度较CFD提升2 - 3个数量级,为飞行器气动分析提供新路径。

力学与人工智能
产品应用8

豆包大模型 Seed 2.0,有点不一样

大模型升级频繁令人审美疲劳,但豆包大模型Seed 2.0不同,其核心是Skills调用能力。作者测试了它做的小红书长图文排版生成器和古文翻译器,还体验了APP“专家模式”,展现模态理解优势。

刘言飞语