研究型AI」共找到 10590 篇相关文章

新闻资讯7

Salesforce 最新研究:LLM 智能体 CRM 测试成功率低至 35%,保密意识还低,企业敢用吗?

Salesforce AI 研究团队新基准测试显示,LLM 智能体在 CRM 测试中表现欠佳,单步任务成功率约 58%,多步任务降至 35%,且保密意识低,与企业需求差距大。

InfoQ
开源动态8

1.4K Star!不要问答,要完成任务,一个合格的金融Agent应该是什么样?

过去一年AI Agent火热,但金融场景投研是长链路任务,有诸多硬约束。LangAlpha是Ginlix AI推出的开源金融Agent项目,能解决实际金融研究任务,有核心架构和关键能力,还给出使用方式、典Demo及横向评测。

开源星探
推荐文章7

幸好图灵不是一位好棋手

本文讲述图灵因棋艺平庸常和唐纳德·米奇对弈,二人合作博弈树算法成AlphaGo核心。米奇受其影响成AI研究先驱,开发算法、程序,其对国际象棋残局的研究影响众多后来者。

量子位
新闻资讯8

震撼!OpenAI神秘模连破6道前沿难题,奥特曼:AI在造「新知识」

OpenAI首席科学家爆料,其神秘内部模一周攻克10道未发表顶尖数学难题中的6道。First Proof团队用公开模测试,结果冷峻。虽OpenAI实际命中率或低于宣称,但AI解前沿题意义重大,也暂无法取代数学家。

新智元
算法论文8

LeCun有了新证据!大模思考与人类思考存在本质差别

Yann LeCun参与的研究用信息论揭示大语言模与人类在‘理解世界’上的本质差异。研究引入新量化框架,分析主流大模,发现AI与人类在‘理解’上有三大核心差异,对当前AI发展趋势提出挑战。

AI工程化
新闻资讯7

AI 是否已经杀死了敏捷宣言

凯捷集团执行副总裁 Steve Jones 宣称“AI 已杀死敏捷宣言”,指出智能体 SDLC 与敏捷宣言存在根本性矛盾,业界反应不一,软件开发正进入方法论变革期,敏捷未来成谜。

InfoQ
产品应用8

搜狐架构演进技术实践:我们如何用 MCP Registry 根治 AI Agent 的“千具之灾”

本文讲述搜狐团队在构建企业级 AI Agent 时遭遇‘千具之灾’,当前路由模方案引发‘治理噩梦’。后通过研究 MCP Registry 获新思路,设计新架构,构建 PoC 原,并对混合路由等问题展开思考。

InfoQ
开源动态8

首个代码世界模引爆AI圈,能让智能体学会「真推理」,Meta开源

Meta重组后的AI部门推出首个代码世界模CWM,是320亿参数开放权重LLM。它与传统大模思路不同,能模拟代码执行。CWM在通用编程与数学任务表现不错,Meta还开放相关检查点以支持研究

机器之心
开源动态8

蚂蚁专用模超越o3!仅用2K训练样本刷新医疗AI榜单纪录

蚂蚁集团联合团队发布《MedResearcher-R1: Expert-Level Medical Deep Researcher》报告,其医学AI智能体MedResearcher-R1用2100条训练样本在医疗基准测试反超通用大模,靠数据、工具、训练方法三大创新实现突破。

量子位
新闻资讯7

英伟达2026奖学金,8位华人博士统治榜单!人均6万美金

2026 - 2027年度英伟达研究生奖学金名单揭晓,10位获奖者中华人学者占8席。该奖学金提供最高6万美金科研经费与暑期实习机会。研究方向涵盖神经渲染、AI安全等,体现英伟达关注具身智能和AI安全。

新智元