「早期答案收敛」共找到 456 篇相关文章
AI浏览器这百亿大蛋糕,谁也没吃到?
2023年大模型火时,AI浏览器被视为百亿创业项目,曾诞生创业热潮。但三年来,它未能让用户换掉传统浏览器,经历从加AI助手到与Agent结合阶段,面临权限、信任等问题,未获主流认可。
Claude推出Agent View:一次管理所有编码会话
Anthropic为Claude Code新增Agent View功能,可集中管理编码会话,已开放研究预览。开发者操作路径清晰,早期用户总结出实用玩法,解决了常开多任务的切换难题,目前部分计划可体验。
刚刚,ChatGPT免费模型升级了:幻觉砍半/记忆更强/回答更简洁
ChatGPT默认模型升级为GPT - 5.5 Instant,免费用户可用。它幻觉减少52.5%,新增“记忆来源”,答案更简洁,语气更温暖自然。从5月5日起向所有用户滚动上线,替代GPT - 5.3 Instant。
股东变对手?OpenAI 被爆砸钱研发 GitHub 替代方案,硬刚微软
外媒披露 OpenAI 正开发代码托管平台,对标微软旗下 GitHub。因 GitHub 服务中断影响研发进度,项目处早期,或数月后推出,还探讨了商业化路径。OpenAI 巨额融资为拓展业务提供支撑。
SmartSearch:奖励驱动query精炼,让Agent中的RAG会“改错”
现有LLM搜索Agent忽视‘如何提问’致答案易出错。SmartSearch提出‘过程奖励+查询精炼’双机制,让Agent学会‘写不好就改’,代码已开源。经实验,它在六数据集全面领先,各机制缺一不可。
曾对AI嗤之以鼻,如今2周生成7万行代码:Rust大佬与Claude联手打造新语言Rue
2025年,Rust社区早期核心人物Steve Klabnik心态转变,开始借助Claude编写代码。他重启念头设计新语言Rue,探索编程语言‘中间地带’,两周生成约7万行代码,开发中人与AI分工明确。
Token售卖已无溢价、大模型公司转型“系统商”?记忆张量 CTO 李志宇:智能体能力会拉开差距,长期记忆与状态管理成竞争核心
InfoQ 采访记忆张量 CTO 李志宇,他指出 Scaling up 经济效益下降,大模型公司正变系统公司,核心是长期记忆与状态管理能力。2026 年若模型无代际差,价格战或加剧。智能体是主赛道,但现有模型推理能力不足。
马斯克亲自点名Karpathy迎战Grok 5!别神话LLM,AGI还要等十年
OpenAI创始元老Karpathy称AGI仍需10年,指出实现AGI难题多。马斯克点名其与Grok 5编程大战被拒。Karpathy还谈及LLM、强化学习、智能体等观点,主张合理看待AI发展。
Computer Use:莫拉维克悖论
2025年AI在数学证明等“高阶智能”任务表现佳,在“像人类一样使用电脑”任务却受挫,再现莫拉维克悖论。文章分析计算机使用智能体是实现AGI机会与挑战,指出发展难题、探讨RL作用并给出研究方向。
大模型如何推理?斯坦福CS25重要一课,DeepMind首席科学家主讲
Google DeepMind首席科学家Denny Zhou在斯坦福CS25课程分享大语言模型推理见解,总结了四个关键点,阐述推理机制、优化方法及最新进展,还介绍多种推理方法并比较其优劣。