Agent能力」共找到 5213 篇相关文章

新闻资讯8

全球首个自主科研Agent挑战赛!零人工干预冲击CNS成果SOTA,科研变天?

3月1日,由上智院和复旦大学主办的‘AI4S智能体CNS挑战赛’启动报名。赛事聚焦自主科研智能体,设四项挑战任务,要求零人工干预,超越CNS成果SOTA。评审阵容强大,旨在推动科研范式变革。

新智元
算法论文8

61.3%!「人类最后一场考试」AI终于及格了,揭秘Agent自我进化新路径

上海交通大学等联合团队提出MemRL框架,在不微调模型参数下,让AI在“人类最后一场考试”中准确率跃至61.3%。该框架受人类认知科学启发,解耦推理与记忆,实验表现出色,或为AGI提供高效路径。

AI科技评论
新闻资讯8

OpenAI拉响红色警报!暂停广告和Agent,下周发布新模型硬刚Gemini 3

面对Google等对手的竞争,OpenAI宣布进入‘红色警报’状态,下周将发布新推理模型硬刚Gemini 3 pro。Altman暂停部分项目,调配资源升级ChatGPT,重点修补‘模型行为’,提升产品体验,还注重图像生成。背后是融资需求压力。

AI寒武纪
推荐文章7

AI 产品范式探讨:非线性思维、多 Agent 协作才是复杂任务的更优解

本文探讨AI产品范式,指出当前大模型产品设计多将其视为‘万能单兵专家’,但复杂任务下效果不佳。提出群体智能、非线性思维等观点,阐述人机协作方向,介绍新范式及AI产品商业化核心是信任。

Founder Park
推荐文章7

生成式AI第二阶段:个性化AI助理 + AI Agent将颠覆我们的生活工作方式

生成式AI已迈入第二阶段,核心是能“动手办事”的AI智能体。未来AI以AI助理和AI代理形式存在,两者协同工作将带来工作方式革命,但面临记忆、信任、伦理等挑战。

AINLPer
算法论文8

1052篇文献!上海AI Lab发布科学LLM综述:从数据基础到Agent前沿

上海AI Lab主导,25家研究机构共同梳理270+训练集、190+评测集,提出科学数据分层框架与智能体闭环科研新范式。还介绍了模型演进、数据情况、评估基准等,指出数据缺陷并展望走向科学家智能体的三步。

PaperAgent
新闻资讯8

Agent引爆产品新思维、奇点智能研究院正式成立!2025 全球产品经理大会首日精彩速览

8月15日,2025全球产品经理大会开幕,众多专家分享见解。奇点智能研究院成立,聚焦AI多范式转换设六大研究领域。李建忠、方汉等嘉宾探讨AI产业生态、产品创新等,还涉及GenAI交互设计、AI产品“人味”等内容。

AI科技大本营
算法论文8

混合数学编程逻辑数据,一次性提升AI多领域强化学习能力 | 上海AI Lab

上海AI Lab的OpenDataLab团队通过大规模实验剖析RLVR在多领域推理机制。构建多领域评估框架与定制奖励策略,基于Qwen2.5 - 7B系列模型联合训练,有多项关键发现,为构建AI推理模型提供参考。

量子位
算法论文7

LLM已能自我更新权重,自适应、知识整合能力大幅提升,AI醒了?

近期,AI自我演进话题研究讨论渐热。OpenAI奥特曼畅想AI自我改进未来,有爆料称其内部运行递归式自我改进AI。MIT论文提出SEAL框架让LLM自我更新权重,引发热议,实验显示其有提升但也有局限。

机器之心
新闻资讯7

80%到25%逆转!大模型代码能力最新排名:Anthropic不再是唯一的神?

OpenRouter网站有模型使用排行榜,按不同使用场景分类。2024年12月到2025年2月,Anthropic模型编程流量占比曾达80%,后谷歌Gemini 2.5 Pro等抢占份额,其跌至25%以下,Claude 4发布后份额回升。还介绍了OpenRouter特点。

AI寒武纪