新版图灵测试」共找到 4902 篇相关文章

算法论文8

大模型推理学习范式!ExGRPO框架:从盲目刷题到聪明复盘

上海人工智能实验室等团队提出经验管理和学习框架ExGRPO,能科学管理经验。与传统RLVR方法比,它在不同基准提升性能,尤其复杂推理任务,还揭示滚雪球效应,为模型推理训练提供思路。

量子位
开源动态8

给Agent装上“海马体”!上海AILab开源MemVerse,定义多模态记忆范式

上海人工智能实验室开源MemVerse,这是首个面向智能体的通用多模态记忆框架。它将多模态信息与文本对齐到统一语义空间,首创‘双通路’架构与‘记忆蒸馏’技术,让智能体有终身记忆能力,在多模态任务中表现出色。

量子位
开源动态8

阿里开源DeepResearch模型,超强“AI研究员”,开启自主智能体纪元

阿里巴巴通义实验室开源Tongyi DeepResearch模型,是全球首个性能能与OpenAI DeepResearch较量且全开源的Web Agent。它采用先进架构,有两套推理范式,训练方法论有创,实测表现佳,应用场景广,用Apache - 2.0许可证。

AIGC开放社区
算法论文8

推理能力再突破!蚂蚁 | 提出Agentic Deep Research范式,可信度同步增加

尽管LLM能力提升,但复杂任务表现受静态知识限制。业界提出Agentic Deep Research系统,现存系统训练有梯度冲突和奖励稀疏问题。蚂蚁团队提出Atom - Searcher,创推理范式,构建细粒度奖励,结合奖励训练,实验效果佳。

AINLPer
新闻资讯8

2027年至少营收1万亿美元!龙虾就是操作系统丨黄仁勋GTC万字实录

2026年3月16日英伟达GTC大会上,黄仁勋阐述英伟达从芯片公司向AI基础设施和工厂公司的蜕变,给出强劲业绩预期,介绍“Token工厂经济学”,还展示系统、技术,提及AI软件和生态革命等。

芯师爷
产品应用8

360安全云架构全解,AI智能体如何开启「主驾」时代?

AI发展加速,网络安全危机加剧。360安全云在ISC.AI 2025大会发布产品,提出“安全即服务”理念,打造AI驱动的四层架构,发布三大类智能体,为企业提供全生命周期价值交付的安全服务。

甲子光年
算法论文8

大型语言模型稳定强化学习的路径:几何平均策略优化GMPO

本文介绍了大型语言模型稳定强化学习路径——几何平均策略优化GMPO。它是GRPO稳定化版本,通过优化几何平均替代算术平均,解决GRPO训练不稳定问题,在多任务实验中显著优于GRPO。

机器之心
新闻资讯8

孪生素数猜想被GPT-6突破!北大数学07级又出现了

OpenAI发布数学论文,宣布GPT-6 Astra在孪生素数猜想上有进展,用Lean形式化证明把连续素数间距的上界从246推到186。此外,其3D生成效果出色,Codex还增可搜索笔记功能。

量子位
算法论文7

63页的面向AI搜索范式:Multi-agent、MCP、DAG、RL

百度搜索发布63页《迈向人工智能搜索范式》Paper,介绍模块化、多智能体框架,范式协调四个专门LLM代理处理搜索事务,还提及内容及重要性,为下一代AI搜索系统提供基础。

PaperAgent
算法论文8

AI学会左脚踩右脚自进化?Meta华人研究改写Agent法则

Meta华人学者Jenny Zhang联合多机构研究者提出智能体框架HyperAgents(DGM - H)。它打破任务能力与自我改进能力需对齐的局限,能跨任务自我改进,还自动生成基础设施,或改写Agent竞争规则。

新智元