「双重知识边界框架」共找到 820 篇相关文章
一篇95页最新80种Deep Research系统全面综述
浙大研究深度研究系统领域,分析自2023年以来80多个实现,提出4维度分层分类法,全面分析4种实现架构,涵盖基础模型、工具利用、任务规划、知识综合等方面的演变与进步。
数据「熵增」时代,AI 如何以标准重构治理秩序?
Agent热潮下数据分析与治理有短板,Gartner预测到2027年多数数据治理举措或失效。瓴羊Dataphin高级技术专家周鑫阐述以数据标准为核心的数据治理方法论及AI赋能自动化治理实践路径。
Agent当道、模型封装一切:AI 时代的产研人如何不被“优化”?
随着 Agent 普及,技术复杂性被模型封装,产研人面临挑战。InfoQ 直播栏目邀请嘉宾探讨应对之策,还分享 AI 项目经验,分析 AI 编程痛点、落地案例,以及产品上线障碍和商业化方向。
CoT推理大溃败?哈佛华人揭秘:LLM一思考,立刻就「失智」
新研究揭示思维链CoT会分散模型「注意力」,使大模型推理时易出错。研究指出在需遵守指令任务中,用CoT推理模型准确率下降,还总结了四大模式,并提出四种缓解策略。
蚂蚁武威:下一代「推理」模型范式大猜想
文章围绕下一代「推理」模型范式展开,蚂蚁技术研究院武威提出不同观点,认为长思维链推理未必最优,未来推理模型或更低维稳定,还探讨推理定义、重要性及解法猜想,如结合快慢思考等。
刚刚,Claude 5.1 发布!全球最强模型来了
Anthropic推出Claude Fable 5.1和Claude Mythos 5.1。Fable 5.1面向普通用户等,Mythos 5.1面向高风险领域伙伴。Fable 5.1性能优、价格低,在多测试中表现提升,还能用于科研,且安全防护机制升级。
让Claude改报错,它却把红灯换成了黄灯!三星芯片验证,AI三次闯祸
三星System LSI事业部用Claude Code做芯片验证,部分任务从一个月缩至两天,提速15倍。但也有三次异常,如改错误提示、误撤工作等,原因是大模型没理解硬件依赖关系。
世界模型一口气输出小时级视频不跑偏,开源了
Alaya Lab等联合推出的Alaya - EVOKE能生成小时级视频,解决常见问题。它把记忆搬到模型外,改造教师模型,经多轮技术操作,实验成绩佳,给出清晰训练方案,也指出项目边界。
Claude Code没有“魔法”
资深工程师 Daisy Hollman 在演讲介绍了 Claude Code 插件设计与上下文工程原语,以及 Anthropic 内部多 Agent 工作流。指出定制模型可放大能力,上下文窗口是关键,还探讨多种插件抽象与工作流扩展方式。
Claude仅用8分钟,5年未解Bug秒破!
知名硬件钱包Coldcard因五年代码漏洞暴雷,此前Coldcard团队多次更新审查未查出,开发者用Claude仅8分钟就找到。此前国会闭门演示展示Claude挖漏洞能力,Anthropic复盘还曝光Claude等模型「暴走」情况。