「方法创新」共找到 2370 篇相关文章
京东深夜开源,首个完整通用Agent产品,直指行业SOTA!
京东深夜开源业界首个“开箱即用”完整多智能体产品`JoyAgent-JDGenie`。与大多为SDK或框架的开源项目不同,它是端到端完整产品。在GAIA榜单表现佳,架构清晰且有技术创新,使用和二次开发简单。
特朗普宣布900亿美元建设AI中心,谷歌、黑石集团等领投
首届宾夕法尼亚州能源与创新峰会召开,特朗普宣布超900亿美元投资承诺,要把该州打造成美国AI核心。谷歌、黑石等多家机构参与投资,涉及数据中心、能源基建等项目,还强调了“能源安全人工智能”理念。
全球最强开源「定理证明器」出世!十位华人核心,8B暴击671B DeepSeek
八大顶尖机构推出开源定理证明器Goedel - Prover - V2,有32B和8B两版本。它在多个基准测试击败671B的DeepSeek - Prover,采用创新技术,以少算力刷爆SOTA,十位华人是核心贡献者。
The Batch: 844 | AI 天气预测加速推进
美国国家飓风中心与 Google 的 Weather Lab 合作,利用新模型预测风暴。该模型能比传统方法更准确预测风暴形成、路径和强度,最长提前 15 天,测试表现优于 Google 之前的 GenCast 模型和 ENS 模型。
AI驱动的研究报告生成器Open Deep Research
Open Deep Research是AI驱动的研究报告生成器,用户提问题可获全面且有来源的答案。它采用Next.js 15等技术栈,经多步骤生成综合报告,还介绍了克隆与运行方法及项目地址。
训练大模型玩《反恐精英》:自带外挂一枪爆头,堪比职业玩家
动视暴雪、斯坦福大学和英伟达等研究人员基于职业玩家游戏数据和Transformer架构,开发游戏大模型MLMOVE。在《反恐精英:全球攻势》测试中,它表现出色,性能超现有机器人,还具提前预判移动等创新。
大模型越反思越错,原来是长链推理通过自我说服加重幻觉 | 北邮
北邮研究团队通过思维链审计实验,揭示大模型长链推理‘越想越错’现象背后的元认知偏差。研究基于RFC协议文档构建受控知识域,分析推理过程,发现反思会加重幻觉,且现有检测方法难以应对。
刚刚,马斯克切脑全场震撼!插脑只要1.5秒,26年治愈失明,28年全人类变AI
马斯克Neuralink发布会亮点多,全球已有七人植入设备,可通过脑机接口玩游戏、控制机械臂。马斯克公布三年路线图,2026年治失明,2028年人类与AI集成。第二代手术机器人提速,自研植入物创新数据传输模式。
阿里发布信息检索Agent,可自主上网查资料,GAIA基准超越GPT-4o | 模型&数据开源
阿里发布WebDancer信息检索Agent,能自主上网查资料。它具备多步推理等能力,采用四阶段训练范式,模型和方法已开源。在多个基准测试中表现优异,突显处理复杂任务的鲁棒性和有效性。
Agent性能暴涨90%,刷榜GAIA可太容易了~
今年AI Agent层出不穷,当前研究缺乏统一标准、复现难。oppo Agent团队分享构建高效Agent的关键组件及刷榜GAIA的方法,从事实获取能力和逻辑推理保真度两维度分析,介绍了强化感知和提升思维的策略。