智能体任务」共找到 4873 篇相关文章

开源动态8

SafeHarness:告别防御盲区,为智能Harness穿上「全生命周期安全护甲」

在自主AI智能生态中,Harness是核心组件却易成攻击目标。中国科学院信息工程研究所等推出SafeHarness框架,将防御机制融入智能Harness运行生命周期,解决现有安全工具缺陷,实现系统级协同防御。

深度学习自然语言处理
开源动态8

登顶Hugging Face GAIA全球榜首!中兴超级智能终结「AI黑盒」时代

中兴通讯研发的超级智能Co - Sight 2.0登顶Hugging Face GAIA全球权威榜单。它解决传统智能痛点,有全链路可信计算框架等创新架构,其智能工厂和开放标准助力构建生态,展现了智能产业落地潜力。

新智元
开源动态7

Stripe 发布基准测试:AI 智能可开发集成方案,但校验环节存在短板

Stripe推出基准测试套件,评估AI智能构建完整Stripe集成方案的能力,测试聚焦金融系统贴近生产环境的集成场景。测试显示,不同任务类型评测结果差异显著,核心瓶颈在于验证环节,当前智能短板在校验逻辑等方面。

InfoQ
产品应用8

将科研脏活累活真·丢给AI!上海AI Lab推出深度科研智能FlowSearch

上海人工智能实验室推出深度科研智能FlowSearch,它由动态结构化知识流驱动,有三大核心模块。在多个科研基准上性能领先,能让科研更高效,标志科研智能迈向新阶段,还为未来系统奠定基础。

量子位
算法论文8

AGI真方向?谷歌证明:智能在自研世界模型,世界模型is all You Need

谷歌DeepMind研究人员表明,通用AI智能处理复杂长期任务需学习内部世界模型,还证明可从智能策略提取该模型。此研究成果补充多领域,对AI发展和安全意义重大。

机器之心
开源动态8

社区供稿丨AgentCPM-Explore开源,4B 参数突破端侧智能模型性能壁垒

清华大学、中国人民大学等联合研发的 AgentCPM-Explore 智能模型开源,它基于 4B 参数,在深度探索类任务表现佳。有打破参数壁垒等亮点,还开源配套工具,提供应对小模型挑战方法,邀伙伴共建生态。

Hugging Face
产品应用8

腾讯的这款AI数据智能工具Lumos,颠覆了传统的数据分析

文章聚焦腾讯AI数据智能工具Lumos,它是Tomoro的数据智能,采用多智能架构解决复杂问题。文中介绍其技术思路、实践方案,如解决多智能一致性、提升查询响应等,还提及后续优化方向。

腾讯技术工程
开源动态8

智源:ArXiv CLI重磅开源!2亿+开放论文,即将化身科研智能的技能包

智源研究院联合高校与社区开发者研发的 DeepXiv 开源并免费开放。它是面向智能的科技文献综合性工具集,提供数据接入、一站式能力集成、丰富接入形式等核心能力,还通过实战演示展示其在科研任务中的价值。

机器之心
推荐文章7

A2A:多智能的协作总线

文章介绍了A2A协议,它是多智能系统的“协作总线”,能让不同智能安全高效协作。阐述其核心使命、与MCP区别、核心概念、工作流实例,还描绘了“智能社会”愿景,并给出基于官方文档的实现示例。

AIGC开放社区
算法论文8

CVPR2026 | 鬼手想点谁就点谁?LaSM让GUI智能把注意力「收回来」

文章聚焦弹窗式环境注入攻击,指出多模态智能易受环境干扰致目标漂移。提出 LaSM 方法,通过放缩关键层权重让智能注意力回到任务,实验显示其提升防御效果,且对正常任务影响小。

机器之心