「智能问答系统」共找到 4710 篇相关文章
硅基生命的「成年礼」:上海具身智能的入世大考与万亿生态突围
2025年,上海具身智能产业发展迅速。政府通过场景开放、算力平权等举措构建生态。智元、傅利叶等企业成果显著。12月12日GDPS大赛是成果检验,各赛道考验机器人不同能力。
刚刚,OpenAI推出学习模式,AI教师真来了,系统提示词已泄露
今天凌晨,ChatGPT 迎来重磅更新,推出 Study Mode(学习模式)。该模式下,ChatGPT 会帮助用户一步步解决问题,化身导师引导学习。它有交互式提示等多种功能,免费用户也能用,系统提示词还被公开。
Jeff Dean最新访谈:未来开发者人均50个智能体,写需求成核心技能
谷歌首席AI科学家Jeff Dean在访谈中预言,未来开发者人均管理50个智能体,写需求成核心技能。他还揭秘谷歌帕累托前沿策略,介绍蒸馏技术让小模型接近大模型性能,强调多模态及低延迟价值,给出未来模型发展预测。
开启Benchmark的Harness时代:15家学术机构联合发布HarnessEval
8月13日,DeepSeek开源Agent Harness dsh引发行业对“Harness”的关注。近日,MirroS联合多机构发布HarnessEval,将其概念引入评测系统。它使评测从Metric到Harness,形成可执行评测系统,已落地于交互式世界模型。
龙虾也能养龙虾!UCSD发布AIBuildAI智能体,MLE-Bench榜单第一
加州大学圣地亚哥分校团队推出AIBuildAI智能体,用户用自然语言描述任务,它就能自动完成AI模型开发。在OpenAI MLE - Bench测试中,其以63.1%获奖率居首,性能媲美人类专家。
迈向原生全模态AI智能体:人大&小红书发布OmniGAIA新基准
中国人民大学等团队推出 OmniGAIA 新基准及 OmniAtlas 训练框架。OmniGAIA 含 360 个高难度任务,覆盖多领域。实验显示闭源与开源模型差距大,OmniAtlas 显著提升开源模型表现,并指出未来全模态智能体发展方向。
国产开源LLM迎来大爆发的一周:Kimi、腾讯、快手、美团、面壁智能
国产开源大模型迎来爆发,快手、月之暗面、美团、面壁智能、腾讯等接连发布新模型,如快手Keye-VL - 1.5 - 8B刷新视频理解SOTA,美团LongCat - Flash - Chat推理快成本低等。
彻底说清 Human-in-the-Loop:企业级 Agent 系统的关键挑战与LangGraph解法【上】
文章围绕企业级Agent系统中Human-in-the-Loop(HITL)展开,介绍其必要性、常见模式,以LangGraph为框架解读关键挑战与实践,涵盖核心机制、原理解析,还阐述HITL下工具调用的两种管控模式。
Sam Altman:我承认我之前错了,AI 超级系统才是 OpenAI 真正想要的
OpenAI 动作不断,创始人 Sam Altman 在访谈中表示,其目标是构建 AI 超级系统,非「超级 App」。还谈及业务思考,如产品战略、Agent 发展、基建合作,以及 Sora 盈利、版权等问题。
DeepMind大佬最新暴论:单体大模型穷途末路,未来买的不是模型,是"智能路由"
DeepMind研究员Andrew Trask认为,因Scaling Law对资源需求攀升,AI将成协议而非程序。组合不同厂商模型有优势,当主流榜单同等评分时变革加速,之后人们将买“智能本身”。