多任务能力」共找到 7228 篇相关文章

算法论文8

ACL 2025 | 大模型乱试错、盲调用?KnowSelf让智能体有「知识边界感知」能力

ACL 2025 论文《Agentic Knowledgeable Self-awareness》聚焦提升智能体「知识边界感知」能力。KnowSelf 方法让智能体自主调节知识运用,实验显示其性能优,还探索了智能体自我认知方面影响。

机器之心
开源动态8

揭秘开源Agentic‑Doc真能支撑120 W+ 查询?医疗/金融/法务都在用,确实是有这么 6~~~

LandingAI的Agentic Document Extraction是领先OCR且具视觉结构化能力的Python SDK,可处理复杂文档。它功能丰富,架构合理,支持格式输出。在行业有应用,性能提升显著,与同类项目相比优势明显。

小华同学ai
开源动态8

6.6K标星!微软开源Agent自我优化框架,为智能体注入持续学习能力

开发AI Agent常面临部署后难自动优化的问题。微软开源的Agent Lightning,加几行代码就能让Agent自动学习、持续优化,有事件追踪等核心能力,安装简单,应用场景丰富。

开源星探
产品应用8

Claude推出智能体代码审查系统:Anthropic内部同款,接管PR深度抓Bug

Anthropic为Claude Code引入代码审查系统,复刻内部审查机制,调度智能体揪深层Bug。该功能面向团队和企业版用户预览,审查更彻底,虽成本高但有效提升审查质量,还能自定义规则、管控成本。

AI寒武纪
开源动态8

准确回答视频细节!11B模型挑战视频理解「证据级」任务,开源可商用

近日,复旦大学邱锡鹏教授领衔的OpenMOSS团队联合模思智能开源11B参数的模态视觉理解模型MOSS-VL。它能准确回答视频里可被验证的细节、时间、过程和空间关系,有六项证据级能力,架构设计独特,采用Apache2.0开源许可。

量子位
开源动态8

AI版权侵权难以“定罪”?Copyright Detective:首个集成范式检测的交互式版权取证系统

随着生成式AI广泛应用,版权纠纷成AI领域棘手挑战。张登辉等研究人员推出Copyright Detective系统,集成范式检测,解决单一检测局限,为大模型文字版权风险提供全方位“体检”方案。

深度学习自然语言处理
算法论文8

谷歌DeepMind团队新框架:让AI告别每次从头开始,在任务流中越用越聪明

谷歌DeepMind团队联合伊利诺伊大学提出Evo-Memory框架和ReMem架构,改变大模型只能被动检索历史的现状,让智能体实现终身学习。通过基准测试验证其有效性,实验显示ReMem优势明显,还揭示记忆复用关键因素。

AIGC开放社区
算法论文8

ICML 2026 | 将教师冲突转化为动态约束,破解模态大模型推理对齐难题

模态大模型发展中,教师知识蒸馏成提升性能关键,但教师模型存在“概念漂移”问题。悉尼科技大学团队提出 APO 框架,将模型间“漂移”转化为动态负约束,解决模态大模型师蒸馏概念对齐难题,工作被 ICML 2026 接收。

机器之心
算法论文8

让大模型学会「心灵感应」:基于思维沟通的智能体合作范式来了

NeurIPS 2025的论文提出思维沟通概念,建立潜在思维可识别性理论,构建ThoughtComm框架。该框架让模型共享潜在思维,跳过语言冗余歧义,实验显示其提升了协作效率与推理能力,或开启新智能形态。

机器之心
开源动态8

Kimi K2 Thinking突袭!智能体&推理能力超GPT-5,网友:再次缩小开源闭源差距

Kimi K2 Thinking发布并开源,主打“模型即Agent”,能边思考边用工具,连续工具调用200 - 300次。在评测基准超GPT - 5等闭源模型,代码权重遵循MIT协议,可在官网和应用实测。

量子位