中科曙光」共找到 2685 篇相关文章

新闻资讯8

5款大模型考「山东卷」,Gemini、豆包分别获文理第一名

近日,字节跳动Seed团队用2025年山东高考真题对5款大模型进行全闭卷测评。结果显示,豆包Seed1.6 - Thinking获文第一,Gemini 2.5 Pro获理第一。大模型一年间进步显著,未来或融入更多领域。

机器之心
算法论文8

扩散语言模型真的会比自回归好?理论分析结果可能恰恰相反

北京大学和蚂蚁集团研究表明,扩散语言模型虽理论上有并行生成优势,但实践在某些任务推理成本更高。研究通过实验对比,分析了扩散与自回归模型在不同评估指标下的效率,指出选择模型要视任务需求。

机器之心
算法论文8

成本暴降88%!通义实验室、北大发布ZeroSearch,无需搜索即可激活LLM检索能力

信息检索能力对提升大语言模型推理表现至关重要,但现有方法在训练面临文档质量不可控和搜索 API 成本高昂两大挑战。为此,通义实验室和北大提出 ZeroSearch 框架,无需真实搜索即可激活 LLM 检索能力,显著降低成本。

机器之心
产品应用8

一场对话,我们细扒了下文心大模型背后的技术

信通院大模型推理能力评估,文心X1 Turbo获最高级“4+级”。百度AI Day上,副总裁吴甜解析文心4.5 Turbo和文心X1 Turbo,从多模态、深度思考等方面介绍技术,还展示其在多场景应用成果。

量子位
开源动态7

24B模型编程超DeepSeek全家桶,32G内存苹果电脑就能跑,专门针对真实GitHub Issue训练

Mistral发布最新开源编程模型Devstral,参数24B,能在单卡RTX4090甚至32G内存Mac上运行。它专为编程智能体推出,针对真实GitHub Issue训练,在SWE - Bench Verified测试表现出色,还可与All Hands AI框架配合。

量子位
产品应用8

具身智能的无本体数据,终于有了自己的「代表作」

自变量机器人发布的Demo,机器人用数百条无本体数据完成化学实验。其发布的TwinDEX系统由无本体数据采集系统和机器人末端执行器组成,能让无本体数据获接近真机数据的训练效果,重新定义数据采集逻辑。

AI科技评论
开源动态8

具身大满贯还全开源!原力灵机DM0.5登顶RoboDojo,且clone且珍惜

原力灵机的DM0.5登顶具身评测RoboDojo,在记忆维度表现突出,还在其他权威评测成绩优异。它有强泛化能力,在多场景表现佳。其从数据、架构、效率全面升级,且全面开源,赋能具身生态。

量子位
新闻资讯7

人大系团队、天使轮数千万元融资,境瞳技给人类社会建一个「世界模型」

境瞳技获数千万元天使轮融资,要给人类社会建「世界模型」。其社会模拟器已有超 1350 万个 AI Agent,是全球同类系统规模最大、置信度最高的。社会智能赛道在硅谷已吸引大量投资,国内境瞳技是该领域唯一产学研团队。

Founder Park
推荐文章8

模型之上,才是真正的资产

微软CEO萨蒂亚·纳德拉在《没有生态的前沿,立不住》提出,每家公司未来要构建人力资本与Token资本。强调Token资本构建靠学习闭环,还提出检验公司是否拥有Token资本的方法,呼吁避免价值集到少数模型公司。

五源资本 5Y Capital
产品应用7

AI 时代,实时入湖正在告别 ETL:从 Kafka 到 Iceberg 的架构减法

在AI驱动的数据应用场景,企业需同时支撑实时消费、历史沉淀与多引擎复用的数据底座。传统依赖外部ETL作业的流数据入湖方式有诸多问题,本文探讨‘零ETL’趋势,分析Kafka × Table Bucket方案如何降低复杂度。

InfoQ