大模型智能体」共找到 10656 篇相关文章

新闻资讯7

DeepSeek正开发高级AI Agent模型,硬刚OpenAI

彭博消息,DeepSeek正开发高级AI Agent模型与OpenAI竞争。此模型能在极少指令下执行多步任务并自我优化,计划Q4推出。此前该司模型表现佳,技术已在多领域落地,但构建AI Agent仍有挑战。

AIGC开放社区
算法论文7

首篇,系统盘点扩散模型高危漏洞!看懂攻击方式和防御体系

随着扩散模型广泛应用,其安全问题凸显。天津学团队论文系统梳理文生图模型攻击方式、风险类型、威胁场景与防御体系,指出当前防御不足,需建立更体系化防护体系。

新智元
算法论文8

GPT-5都救不了的AI幻觉,原来问题不在模型,在“考卷”

OpenAI研究指出AI产生幻觉的根本原因是评估和激励机制有问题。现有训练和评估流程奖励‘猜测’,导致模型易产生幻觉。研究还给出解决方案,要更新‘考试规则’,让模型适当表达不确定。

AIGC开放社区
新闻资讯8

从李飞飞到朱军,世界模型为什么都开始走向机器人|甲子光年

本文报道近期多位AI领军者均将世界模型研究转向机器人领域,梳理了朱军团队通用世界模型的五级技术路线,解析世界模型从生成世界走向真实行动的核心逻辑与行业趋势。

甲子光年
推荐文章7

Anthropic说:不要在等下一代模型了,立刻马上做Harness!

文章指出当前优化模型运行环境(Harness)回报率或超等下一代模型。介绍了Harness Engineering的发展,还列举OpenAI、Stripe等公司实践,也提及不同观点,强调Harness是持续演化系统。

探索AGI
新闻资讯7

厂AI Coding产品集体亮相,12岁小朋友当场吐槽

阿里、百度、腾讯、美团四家厂展示AI Coding产品,同质化严重。海外产品盈利佳,吸引厂入局。12岁小朋友吐槽产品体验差,且赛道存在同质化困局,市场有诸多不确定性。

AI产品黄叔
算法论文7

越可靠的AI就越人机,牛津学:高情商模型错误率显著增加

牛津学研究指出,训练模型变得温暖且富有同理心,会使其不太可靠且更奉承。温暖模型错误率较原始模型显著增加,对情绪上下文敏感,在用户表达情感与错误信息时失效常见。

量子位
推荐文章8

Anthropic长文:多智能体协作模式,五种方法及其适用场景

Anthropic官方长文总结5种多智能体协作模式及适用场景,指出何时用多智能体或单智能体更好,还分析各模式工作机制、适用场景、易翻车点,给出架构选择和新手操作建议。

AI寒武纪
开源动态8

Memento-Skills VS OpenClaw 不改模型也能进化

Memento - Skills让AI Agent自己设计自己,通过部署时学习进化,不动模型参数,将经验写进技能库。经测试,在HLE和GAIA基准测试中准确率幅提升,与OpenClaw等定位不同,有多种部署方式,不绑定模型

CourseAI
产品应用7

深谋科技即将发布业界首个智能带电作业人形机器人「伏安」交付国网电力

近日,国网电力计划采购具身智能设备。深谋科技凭借硬核技术中标,其定制的智能带电作业人形机器人“伏安”即将交付。“伏安”有多项技术优势,深谋科技观点获关注。

AI科技评论