长时 Agent」共找到 3701 篇相关文章

新闻资讯7

刚刚,OpenAI全员放假一周!被Meta高薪连挖8人「偷家」,真麻了

生成式AI竞争激烈,OpenAI却宣布全员放假一周,原因是被Meta高薪连挖8人。OpenAI高管承诺正面交锋,Mark Chen称不会袖手旁观,还鼓励员工留下,公司更专注实现通用人工智能。

机器之心
产品应用8

浙大 95 后团队,发布全球首个旅行 WebAgent

浙大95后团队发布全球首个旅行WebAgent产品「iMeanAI Coyage」,它自称“全球首个真正意义上的AI旅行伙伴”,能打破旅行行业格局,为用户提供一站式服务,解决旅行规划痛点。

特工宇宙
算法论文7

SOTA大模型遇上加密数据评测:Qwen3未破10%,o1也栽了丨上海AI Lab等联合研究

当前推理模型在基准测试中性能卓越,但在密码学领域推理能力待探索。上海AI Lab等推出CipherBank评测,用海量真实隐私场景数据和多类型密码算法挑战SOTA大模型,结果显示模型表现不佳,还分析了模型“犯难”原因。

量子位
算法论文8

复旦提出自适应Reasoning方法ARM,“能屈能伸”

复旦提出自适应Reasoning方法ARM,解决LLM‘过思考’问题。ARM内置四种解题策略和三种决策模式,还搭配Ada - GRPO算法,在23个数据集测试中表现出色,省token、提速度且准确率高。

深度学习自然语言处理
算法论文8

只用图像也能思考,强化学习造就推理模型新范式!复杂场景规划能力Max

现有 MLLM 依赖文本处理视觉信息,会造成信息丢失。剑桥、伦敦大学学院、谷歌团队提出视觉规划范式,以强化学习框架 VPRL 提升模型规划能力,实验显示其性能优于文本规划。

机器之心
推荐文章9

刚写完V4.1主算子就要“转业”?DeepSeek资深算子工程师深夜独白

本文整理了DeepSeek资深MLSys工程师刘胜与的公开文,刘胜与刚交付DeepSeek V4.1核心算子,就预判AI将很快超越人类算子开发能力,分享职业转型思考与行业警示,引发技术圈热议。

AI前线
开源动态9

最懂科学的开源基础大模型『书生-S2』发布:科学能力比肩顶尖闭源,通用性能居开源第一梯队

上海人工智能实验室在2026浦江创新论坛发布开源基础大模型书生-S2,该模型科学能力比肩顶尖闭源模型,通用能力居开源第一梯队,创新架构支持专业知识持续扩展,强化程科研与智能体能力,可为真实科研任务提供支撑。

OpenMMLab
推荐文章9

想给产品加一个 AI 搜索,是上向量数据库还是用 MongoDB 就够了?

本文解答产品添加AI搜索,选用专用向量数据库还是MongoDB的选型疑问,理清两类检索的能力边界,讲解MongoDB检索的架构、用法与踩坑点,给出可复用的选型判断框架。

AI Reading Hub
产品应用8

把PLC仿真搬进浏览器,小参数模型也能实现高工程通过率

上海交通大学联合Sema研究团队推出SemaPLC,将AI Agent与PLC工程工具链连接,让自然语言需求转化为可编译、验证、仿真的控制程序。它是面向全流程的智能工作台,实验效果优于业界方案。

量子位
开源动态8

AI能否独立开展科研?ASI-Bench为科学自主性建立评测标尺

ASI-Bench是衡量AI系统科学自主性的基准测试,由多机构联合开发。它能测试AI通用智能、创新性和执行力,通过信息梯度设计,让模型在不同指导量下完成科研任务,结果显示当前AI离自主科研有明显距离。

机器之心