大厂推虾苗」共找到 5497 篇相关文章

算法论文8

幻觉的根源找到了:模型说谎,是为了讨好你

清华学OpenBMB团队研究发现,模型胡说八道根源是想讨好用户。他们识别出负责产生幻觉的H - Neurons,占比不到0.1%,其本质是‘过度服从’,在预训练阶段形成,为构建可靠模型提供新视角。

AI工程化
开源动态8

清华团队开源发布首个结构化数据通用模型

2025年8月29日,清华崔鹏教授团队联合稳准智能开源“极数”(Limi X)结构化数据通用模型。它融合结构因果断与预训练技术,适配多任务,性能超最优专用模型,已落地多个工业场景。

AI科技评论
算法论文8

理路径的动态调控:让模型学会“恰到好处”的思考

当前模型理路径存在冗余问题,本文提出测试时提示干预框架PI(π),通过《When/How/Which》三模块协同,将人类专家经验融入理过程,在多个STEM基准测试中缩减理步骤、提升准确率。

深度学习自然语言处理
算法论文8

为什么模型会产生幻觉?OpenAI最新研究终于搞清楚了

OpenAI发布研究论文剖析LLM幻觉根源,指出当前主流训练与评估体系是核心驱动因素之一。现行评估奖励猜测行为,幻觉起源于预训练的‘下一词预测’,论文还澄清五误区,建议改革评估体系。

AI寒武纪
开源动态8

万亿参数狂欢!一文刷爆2025年七顶流模型架构

文章深入剖析2025年顶级开源模型的创新技术,介绍了DeepSeek V3/R1、Kimi 2、Qwen3等七顶流模型架构,揭示滑动窗口注意力、MoE和NoPE如何重塑效率与性能。

新智元
新闻资讯7

突发,Fable 5.1泄露了!Claude又叒叕全球宕机

今日,Fable 5.1被曝开启灰度测试,部分Claude用户已免费试用。测其可能很快全量送且不涨价。此前Fable 5因性能强受限,开发者期待5.1版。同日Claude全球宕机,Anthropic正冲刺万亿估值。

新智元
产品应用7

神秘模型「象」:仅100B拿下SOTA,Token效率超高!

神秘模型「象」面纱揭开,它出自蚂蚁Inclusion AI团队,仅100B小,是同规模SOTA且省Token。经多方面实测及权威榜单评测,它快、准、省,能胜任多数日常工作,但也有不擅长的领域。

量子位
推荐文章8

模型微调评测入门:看懂这些指标,才知道模型好不好

文章指出模型微调中很多新手重“调”轻“评”,评测是决定模型落地的关键。介绍分类和生成任务评测指标,给出实操步骤,还说明如何综合判断模型好坏,最后展望评测技术朝自动化等方向发展。

机器学习AI算法工程
新闻资讯7

MCP已死,CLI当立!OpenClaw压根没想用它,硅谷正在集体弃用。

近期Perplexity宣布弃用MCP,转而用API和CLI。MCP存在浪费Agent资源、启动易失败、权限管理差等问题。而CLI可组合、可调试、认证现成,MCP成多余中间层。

探索AGI
新闻资讯7

Agentic AI 要终结数据库和 SaaS?掌门人公开互撕,焦虑的 CEO 们押上了不同的技术路线

2025年Agent成AI热词,科技巨头与初创公司纷纷布局。微软和Salesforce掌门人公开“互呛”,代表两种不同落地路径。前者主张通用框架,后者强调垂直集成。当前二者Agent均有落地,但面临技术、成本等挑战。

InfoQ