研究与产品」共找到 7851 篇相关文章

新闻资讯7

Salesforce 最新研究:LLM 智能体 CRM 测试成功率低至 35%,保密意识还低,企业敢用吗?

Salesforce AI 研究团队新基准测试显示,LLM 智能体在 CRM 测试中表现欠佳,单步任务成功率约 58%,多步任务降至 35%,且保密意识低,企业需求差距大。

InfoQ
算法论文8

手机AGI助手还有多远?移动智能体复合长程任务测试基准调度系统发布

上海交大澜舟科技研究发现现有移动端GUI智能体处理复合长程任务能力不足,提出UI - Nexus测试基准和Agent - NEXUS调度系统,经实验能提升任务完成率,也为AI原生操作系统建立雏形。

机器之心
算法论文7

无需准确传感信号!轻松搞定「多段软体机械臂」复杂位姿形状控制

研究人员提出利用双向循环神经网络(biLSTM)的MSCA规划控制策略,即便用不准确内部传感信号也能完成任务。实验显示该方法在多任务中表现优异,未来还将做进一步研究

新智元
推荐文章8

Agent面向结果交付,技术正从单点突破加速转向工程系统竞争 |《中国软件技术发展洞察和趋势预测研究报告 2026》正式发布

2025 年技术热点不断,竞争重心从单点突破转向系统级等竞争。InfoQ 研究中心发布《中国软件技术发展洞察和趋势预测研究报告 2026》,盘点技术发展,还展望 2026 年十大技术趋势。

InfoQ
8

中科院信工所发布首篇LLM智能体幻觉综述!梳理5类幻觉、18大诱因10种缓解方案,300+论文资源开源

中科院信工所等机构团队发布首篇聚焦LLM智能体幻觉的综述,厘清其传统语言幻觉区别,提出5类幻觉分类体系和18大触发原因,给出10种缓解策略,还开源300+论文库并指明未来研究方向。

深度学习自然语言处理
新闻资讯7

理解生成统一多模态模型:现状未来 | 直播预约

从GPT - 4o到Gemini,AI实现跨模态联合理解生成,核心是统一多模态基础模型。但开源社区构建强大统一模型面临挑战。南大等团队梳理超750篇论文分析技术路线,将有直播探讨现状未来。

深度学习自然语言处理
8

AI 巨头对话:Sam Altman Satya Nadella 论 AI 未来、算力微软王牌

OpenAI的Sam Altman和微软的Satya Nadella在播客中探讨AI未来等话题。涉及1.4万亿算力投入、微软OpenAI新合作协议细节,指出瓶颈在数据中心和电力,还谈及AI经济模型、未来愿景等。

宝玉AI
推荐文章8

AI 开发时代的“能力暴露禁止空间”方法论:TPDD 高层测试闭环

文章指出大模型加速软件开发范式演进,AI 深度介入开发带来新生路径,但也放大风险。作者提出 TPDD 方法论,通过提前定义测试点边界条件,平衡能力利用风险控制,确保系统可控、安全、可持续。

InfoQ
产品应用7

BrowseComp等评测集第一,秘塔推出「深度研究」,已开启免费公开访问

世界变化快,AI领域新概念不断。秘塔在上线“浅度研究”五个月后,将其升级为“深度研究”。该模块最初由OpenAI推出,秘塔版可免费公开访问,准确率优,还让研究过程可见。

深度学习自然语言处理
推荐文章8

深度拆解 Claude 的 Agent 架构:MCP + PTC、Skills Subagents 的三维协同

Anthropic 在 Agent 工程领域不断创新,除了 MCP 外还推出 Skills PTC 并在 Claude 平台落地。本文深度拆解 MCP + PTC、Skills Subagents 的定位、联系应用,助你拓展构建 Agent 系统的思维。

AI大模型应用实践