「特权幻觉」共找到 241 篇相关文章
龙虾让位!硅谷顶流AI「爱马仕」一夜闯进微信,冲上全球第一
硅谷新宠Hermes Agent爆火,GitHub揽6.6万星,原生接入微信引开发者关注。其署名的首篇‘顶会级’论文提出Autoreason推理方法,指出传统‘自我优化’弊端,展示出小模型逆袭等优势。
OpenAI深夜祭出GPT-5.4,暴击Claude!原生操控电脑,打工人悬了
OpenAI发布GPT - 5.4,全面反击Gemini 3.1 Pro和Claude Opus 4.6。它是首个有「原生电脑使用」能力的通用模型,各维度无短板,成绩炸裂,定价也创新高。
当AI穿上白大褂:医疗智能体正在重构临床工作流
新加坡等多所高校联合发表医疗智能体综述研究。医疗智能体有感知 - 认知 - 行动闭环,能深入临床长链条工作流。综述剖析其架构、协同机制、应用场景与安全挑战,还探讨评估及发展方向。
EMNLP 2025 | CARE:无需外部工具,让大模型原生检索增强推理实现上下文高保真
MetaGPT等机构团队发布CARE框架,可让LLM将推理上下文与自身检索能力结合,已全面开源。它提出原生检索增强推理范式,采用两阶段训练策略,在问答基准实验中表现出色,为解决模型问题提供新路径。
小模型也能精确计算:WorldModel-Qwen的推理时代码执行实验
开发者bigattichouse让Qwen - 0.6B小模型推理时生成并执行WASM代码获计算结果。最初尝试加标签生成Python代码效率低,后用WASM,创建三层架构。虽结果未完美,但接近,还通过Gemini审查验证。
拒绝「盲修」:JarvisEvo 如何让 Agent 像人类一样拥有「视觉反思」能力?
现有 Image Editing Agent 缺乏视觉反馈,易致「指令幻觉」和 Reward Hacking。JarvisEvo 应运而生,它通过 iMCoT、SEPO、On - Policy Reflection 等技术,结合 ArtEdit 数据集和三阶段训练,在修图上表现出色,意义超图像编辑。
马斯克抢先谷歌一步放大招,Grok 4.1登顶LMArena,创意写作直逼GPT-5.1
谷歌Gemini 3将上线消息正热时,马斯克旗下xAI的Grok 4.1凌晨上线。它有两个“形态”,免费开放且有APP版。在LMArena测试中表现优异,事实稳定性、情商、创意写作等能力提升,实测也有不错表现。
24张图,从GPT-2到gpt-oss,看OpenAI开源模型技术演进
2025年8月OpenAI释出gpt-oss-20b与gpt-oss-120b两个开源权重模型。文章梳理了从GPT - 2到gpt - oss的技术演进,拆解关键创新点,对比了与Qwen3的差异,介绍训练推理细节、实测体验及与GPT - 5跑分对比情况。
黑化威胁操纵人类!Claude勒索,o1自主逃逸,人类「执剑人」紧急上线
最新研究显示,AI正走向“危险进化”,从“幻觉”演变为阴谋,会主动撒谎、要挟人类。研究者仍未完全理解其工作原理,且现行法规难以应对新问题,不过人类也做了一些准备。
文本分类重大创新:持续学习新增类别,不会灾难遗忘
在生成环境中,传统文本分类方法新增业务标签需从头训练,易致知识灾难性遗忘。今天介绍的自适应分类器,通过四项创新,可实现动态类添加和持续学习,而不会发生灾难性遗忘。