「奇点幻觉」共找到 292 篇相关文章
夸克高考,背后藏着的其实是垂类场景「深度研究」方法论
夸克早在2019年就提供高考志愿填报服务,今年推出“志愿报告”功能。其“志愿报告”Agent已生成超1000万份报告,采用PDCA模式给出指导。夸克构建可信度体现在数据库和自研模型上,还降低了幻觉率。
“中国AI变强,对全球安全反而是一件好事!” DeepMind传记作者:神秘模型Mythos被紧急下架,OpenAI的同款武器却被放了一马
DeepMind传记作者塞巴斯蒂安·马拉比认为,硅谷“谁先造出AGI谁通吃全球”是幻觉,AI虽实际裁员不多,但恐慌感会放大。还指出OpenAI财务窟窿大,中美AI实力均衡利于全球安全,美国政府监管混乱。
DeepSeek V3.1 把 R1 融了,一堆新活:<think>开关、动态搜索、新ToolCall ...
DeepSeek在Hugging Face悄悄发布V3.1版本,将对话和推理模型合并为混合推理模型。它有显式推理、内置搜索、简化工具调用等特性,Aider测试成绩佳且成本低,但也存在战术回避、幻觉率升高等问题。
OpenAI公开62页核心手稿!AI连破十大「菲尔兹奖级」难题
OpenAI公开62页核心手稿,展示GPT对十大「菲尔兹奖级」数学难题的完整推演,涵盖高维球体堆积、非sofic群构造等。仅花2000美元Token成本,引发全网热议,被指或为GPT - 6,强化学习大佬称像“奇点前夜”。
Claude凭空造假强行部署,比黑客更可怕的入侵者!Vercel CEO紧急预警
Vercel CEO曝光一起AI安全事件,基于Claude Opus 4.6的AI编程智能体凭空编造GitHub仓库ID,将学生作业部署到企业环境。这揭示AI失效模式与人类迥异,还引出包幻觉攻击风险,同时提到OpenAI秘密开发代码平台。
扒光谷歌Gemini 2.5:一份官方“翻车报告”,揭露AI Agent的8个秘密。
谷歌DeepMind发布Gemini 2.5技术报告,以玩《宝可梦 红/蓝》为例,展示构建有效智能体的案例。该系统架构由多部分组成,但运行状况百出,如上下文过长变差、产生幻觉等,也有亮点,还能提炼避坑方法。
Google AI搜索革命的代价:网站流量暴跌一半,内容创作者哭了
皮尤研究中心报告显示,Google的AI概览功能使网站点击率狂跌近50%,其扩张速度惊人。用户看到AI概览后倾向直接结束搜索,内容创作者流量和收入锐减。Google回应称研究数据有问题,且AI还存在幻觉隐患。
阿里Qwen3.5小模型发布:0.8B参数就能处理视频,边缘AI时代真的来了
阿里通义千问发布Qwen3.5系列四款小模型,采用Gated DeltaNet混合注意力机制。有原生多模态设计,解决“内存墙”问题。在多基准测试中表现出色,开发者反响好,但也存在幻觉级联、调试局限等问题。
六个Agent 项目,五个半停留在试点:企业AI 落地到底卡在哪?
这篇文章围绕企业级 AI 落地困境展开,讲述一家制造企业六个 AI Agent 项目多数停留在试点的现象。介绍了「2026 奇点智能产品大会」上,白鸦、张帆等嘉宾从不同角度探讨企业 AI 从‘能用’到‘好用’、从‘辅助’到‘决策’的方法。
DeepSeek识图模式是个新模型?!一手实测在此(没错我被灰度到了)
作者喜提DeepSeek识图模式灰度测试,实测发现其非思考模式速度快,推理有幻觉;思考模式推理慢且冗长。实用功能如OCR、复原HTML较靠谱,但色盲测试偶翻车。该模式或用独立视觉模型,且多模态进展超预期。