语出惊人」共找到 1155 篇相关文章

新闻资讯7

不是幻觉!Claude自下指令甩锅人类,百万上下文沦为降智重灾区

Claude深陷「角色混淆」Bug,分不清自己的话与用户指令,长上下文成了降智「重灾区」。开发者Gareth Dwyer记录了该bug,研究发现问题在底层架构的角色标记缺陷。学术界也关注此问题,整个行业需系统性应对。

新智元
8

“10周的工作量,AI只用4天!”Anthropic发布会全程实录:你引以为傲的复杂工程,在模型眼里只是个玩具

Anthropic举办‘Code w/ Claude’开发者大会,指AI模型能力呈‘指数级’增长,多数企业开发模式却停留在‘线性’阶段。大会祭三大杀手锏,包括更强底层模型、Claude Platform代理编排能力和Claude Code桌面端。

AI科技大本营
推荐文章7

智谱公布“降智”的秘密:Scaling不可避免的痛

智谱最新技术博客大倒苦水,称从GLM - 5以来遭遇「Scaling Pain」。团队排查高负载下推理状态管理等问题致异常,还给避坑指南,如在线异常监控策略,优化后系统更稳定,吞吐量提升。

量子位
推荐文章8

AI的窗口期还剩多久,不同窗口处于什么阶段?战略上车来得及吗

文章指AI窗口期并非单一窗口,而是一组接力现的窗口。分析了基础设施投资、AI人才、AI应用创业等五个维度的窗口期阶段,给识别窗口期的框架,还为普通人抓住窗口期提供了实操策略。

AI Reading Hub
产品应用8

Claude Opus 4.7炸场,6美元造《我的世界》,临门AGI前强调安全,打工人却更慌了

Anthropic 发布‘目前最强 Opus 模型’Claude Opus 4.7,能力跃升,在多榜单夺冠。写代码、看图表等能力提升,也有网页搜索等能力下降。还展现游戏开发实力,同步上线Claude Code新功能,加强安全防护。

鲸选AI
开源动态8

告别直接生成,文生图进入Agent时代:港中文联合伯克利开源Gen-Searcher

过去文生图多是‘直接图’,遇真实世界知识等易翻车。港中文等团队提Gen - Searcher,让图像生成模型像Agent一样搜索等,数据、模型和代码均已开源,实验显示它提升了生图准确性和质量。

机器之心
新闻资讯8

Karpathy 亲手终结了RAG的草莽时代

Andrej Karpathy分享“LLM Wiki”工作流,将多数Token用于构建“可演化知识库”。此方法不依赖复杂架构,在中等规模数据集上展现强大能力,引发“LLM Wiki杀死RAG”的讨论,在技术社区和企业级市场反响热烈。

InfoQ
新闻资讯8

陶哲轩:AI 正在让“想法”变得廉价,而真正的瓶颈从未改变

数学家陶哲轩与Dwarkesh Patel访谈,探讨AI在科学发现中的作用。他指AI让‘想法生成’成本降为零,验证想法成新瓶颈;AI擅长广度,人类擅长深度;AI负责找证明,人类提炼‘理解’与‘智慧’。

力学与人工智能
推荐文章7

AI越强,企业越迷茫:顶尖CIO们的十大真实之问

阿里云CIO与40余家头部企业CXO深度碰撞,总结《企业智变下的CIO集体之问》。报告指企业AI落地困境,如数字人认知混沌、知识库建设难等,探讨十大经典问题,为企业提供思考方向。

InfoQ
算法论文8

对抗KV Cache压缩的脆弱性:两行代码以最坏风险控制防御底层假设崩塌

中科大团队在 ICLR 2026 论文中指 KV Cache 压缩领域底层假设存在缺陷,主流方法基于的稳定性假设在真实场景中脆弱。团队提防御性聚合策略,仅两行代码修改,显著提升 KV Cache 压缩性能。

机器之心