大厂自研」共找到 5829 篇相关文章

新闻资讯7

光刻机巨头ASML,108亿控股了一家模型公司

光刻机巨头ASML领投法国AI明星公司Mistral AI的C轮融资,砸13亿欧元成第一股东,推高其估值至100亿欧元。Mistral开源与商业化并行,ASML投资或提升光刻机效能。

量子位
算法论文8

LLM-in-Sandbox:给模型一台电脑,激发通用智能体能力

中国人民学、微软研究院和清华的研究者提出LLM - in - Sandbox范式,让模型在代码沙盒完成任务,实验显示其能提升多领域表现,无需额外训练,还能减少token消耗,研究者认为应取代纯LLM推理。

机器之心
新闻资讯7

模型能复刻这些系统吗?ProgramBench给出了残酷答案

斯坦福NLP组发布ProgramBench,用200个完整代码库重建任务测试主流模型,要求模型仅根据可执行文件还原如SQLite等项目完整代码,结果所有模型实际解决率为0%,说明模型更擅模仿代码表面结构。

AI工程化
算法论文8

幻觉的根源找到了:模型说谎,是为了讨好你

清华学OpenBMB团队研究发现,模型胡说八道根源是想讨好用户。他们识别出负责产生幻觉的H - Neurons,占比不到0.1%,其本质是‘过度服从’,在预训练阶段形成,为构建可靠模型提供新视角。

AI工程化
开源动态8

清华团队开源发布首个结构化数据通用模型

2025年8月29日,清华崔鹏教授团队联合稳准智能开源“极数”(Limi X)结构化数据通用模型。它融合结构因果推断与预训练技术,适配多任务,性能超最优专用模型,已落地多个工业场景。

AI科技评论
算法论文8

推理路径的动态调控:让模型学会“恰到好处”的思考

当前模型推理路径存在冗余问题,本文提出测试时提示干预框架PI(π),通过《When/How/Which》三模块协同,将人类专家经验融入推理过程,在多个STEM基准测试中缩减推理步骤、提升准确率。

深度学习自然语言处理
算法论文8

为什么模型会产生幻觉?OpenAI最新研究终于搞清楚了

OpenAI发布研究论文剖析LLM幻觉根源,指出当前主流训练与评估体系是核心驱动因素之一。现行评估奖励猜测行为,幻觉起源于预训练的‘下一词预测’,论文还澄清五误区,建议改革评估体系。

AI寒武纪
新闻资讯8

中国科幻会聚合力 铸就首钢园未来产业新高地

2026第十届中国科幻会3月27日开幕,这是该盛会第六次落地首钢园。2020年结缘,首钢未来数字空间创新高地渐成实景。首钢聚焦科幻等新质生产力领域,构建多元体验矩阵,以“会”聚产,推动科幻产业生态繁荣发展。

首钢园
开源动态8

万亿参数狂欢!一文刷爆2025年七顶流模型架构

文章深入剖析2025年顶级开源模型的创新技术,介绍了DeepSeek V3/R1、Kimi 2、Qwen3等七顶流模型架构,揭示滑动窗口注意力、MoE和NoPE如何重塑效率与性能。

新智元
新闻资讯7

突发,Fable 5.1泄露了!Claude又叒叕全球宕机

今日,Fable 5.1被曝开启灰度测试,部分Claude用户已免费试用。推测其可能很快全量推送且不涨价。此前Fable 5因性能强受限,开发者期待5.1版。同日Claude全球宕机,Anthropic正冲刺万亿估值。

新智元