幻觉现象」共找到 356 篇相关文章

新闻资讯8

OpenAI深夜祭出GPT-5.4,暴击Claude!原生操控电脑,打工人悬了

OpenAI发布GPT - 5.4,全面反击Gemini 3.1 Pro和Claude Opus 4.6。它是首个有「原生电脑使用」能力的通用模型,各维度无短板,成绩炸裂,定价也创新高。

新智元
算法论文8

当AI穿上白大褂:医疗智能体正在重构临床工作流

新加坡等多所高校联合发表医疗智能体综述研究。医疗智能体有感知 - 认知 - 行动闭环,能深入临床长链条工作流。综述剖析其架构、协同机制、应用场景与安全挑战,还探讨评估及发展方向。

AIGC开放社区
新闻资讯7

第一批人形机器人,已经开始倒闭了

人形机器人被视作“下一个万亿终端”,但2025年赛道先传来倒闭声,如K - Scale Labs烧光融资关门。融资收紧、供应链缺位,技术、成本、场景等难题待解,不过人形机器人未来在多场景有潜力。

芯师爷
开源动态8

EMNLP 2025 | CARE:无需外部工具,让大模型原生检索增强推理实现上下文高保真

MetaGPT等机构团队发布CARE框架,可让LLM将推理上下文与自身检索能力结合,已全面开源。它提出原生检索增强推理范式,采用两阶段训练策略,在问答基准实验中表现出色,为解决模型问题提供新路径。

机器之心
新闻资讯8

Sora2甚至可以预测ChatGPT的输出

Sora2表现太卷,能预测ChatGPT输出,模拟交互还能渲染HTML,懂代码也懂物理,能体现玻璃折射现象,还能精准还原游戏支线任务关键要素,或基于LLM训练。

量子位
新闻资讯7

Resume Builder报告:多数经理使用AI来决定,晋升或解雇员工

Resume Builder调查显示,65%美国管理者工作用AI,94%用其对下属决策,涵盖晋升、加薪等多方面。71%管理者对AI公平决策有信心,但不少人让AI无人类干预决策,且多数管理者缺相关培训。

AIGC开放社区
算法论文8

SFT「不完全学习」之后,研究的下一个前沿在哪?ACL 2026 腾讯混元论文未来方向展望

本文从不完全学习现象出发,展望SFT领域未来研究方向,如未知根因探索、检测方法改进等,还提及推广到其他训练范式、CPT精细化研究等,给出研究优先级和社区建议。

InfoQ
新闻资讯7

Clawdbot作者:亿万富豪本豪,复出只因退休太空虚

火爆全网的Clawdbot作者是亿万富翁彼得。他2011年创业,2021年套现1亿欧元退休,四年后因空虚复出,2026年推出Clawdbot,这是7x24小时开源AI助理,功能强大。

量子位
开源动态7

小模型也能精确计算:WorldModel-Qwen的推理时代码执行实验

开发者bigattichouse让Qwen - 0.6B小模型推理时生成并执行WASM代码获计算结果。最初尝试加标签生成Python代码效率低,后用WASM,创建三层架构。虽结果未完美,但接近,还通过Gemini审查验证。

AI工程化
算法论文8

拒绝「盲修」:JarvisEvo 如何让 Agent 像人类一样拥有「视觉反思」能力?

现有 Image Editing Agent 缺乏视觉反馈,易致「指令幻觉」和 Reward Hacking。JarvisEvo 应运而生,它通过 iMCoT、SEPO、On - Policy Reflection 等技术,结合 ArtEdit 数据集和三阶段训练,在修图上表现出色,意义超图像编辑。

机器之心