AI 大模型」共找到 13957 篇相关文章

算法论文8

ICML 2026 | 模型内部也会长出「情绪树」,规模越越懂人心

ICML2026 论文指出,语言模型内部会自然形成类似人类心理学模型的「情绪树」,模型,情绪树越复杂,且在销售等任务上表现更好。同时,模型的情绪结构受身份设定影响,存在与人类相似的情绪识别偏见。

机器之心
新闻资讯8

我在WAIC看见的十趋势

上海世界人工智能会(WAIC)热度空前,一票难求。本文总结了WAIC呈现的十核心趋势,如中国AI因DeepSeek而不同,开源模型进入中国时间,AI创新来到ToC阶段,第一批商业化AI终端是汽车、耳机和眼镜等。

量子位
算法论文8

模型思考装上“猎鹰重装引擎” :腾讯混元 SEAT 重塑深度思考

本文深度解析腾讯混元最新发布的 SEAT 自适应并行扩展推理框架。它让模型 CoT 升级,应对复杂推理任务。该框架通过多轮并行推理和语义熵导航,解决模型深度思考的局限,且适配多种模型,性价比高。

AI科技大本营
新闻资讯8

从Foundation Model到Physical AI,三星「杀入」模型核心战场

三星正快速进入模型核心战场,构建Foundation Model体系,采购GPU用于AI基建。它提出Meki架构、M2RL训练范式和LiveClawBench评测体系,由AI Model TF团队推进,负责人是唐业辉。

机器之心
开源动态8

3B模型性能小钢炮,“AI下半场应该训练+验证两条腿跑步”丨上海AI Lab&澳门

上海AI Lab和澳门学联合发布通用答案验证模型CompassVerifier与评测集VerifierBench,填补Verifier领域循环迭代体系空白。AI下半场评估比训练更重要,当前验证方法有困境,新模型验证精度高且能用于强化学习。

量子位
产品应用8

数学奥赛高分摘金,位列模型榜首,『书生』科学多模态模型Intern-S1能力再升级 | 通专融合新进展

2025年CMO决赛首设AI测试,书生科学多模态模型Intern-S1以102分位列模型得分榜首,远超金牌线和国家集训队入选线。其推理能力提升得益于多项创新,未来将拓展至多领域科研。

OpenMMLab
推荐文章7

LLM不是所有!这几个模型你需要知道!

AI时代不止语言模型,复合AI系统成共识。掌握各类模型特点对构建高质量AI应用关键,文章介绍了LLM、LCM、LAM等多种模型

AI工程化
算法论文7

模型也需要睡觉!让AI打个盹,醒来更聪明

卡内基梅隆学和马里兰学研究发现,模型处理长上下文易累傻。受人脑机制启发,设计睡眠机制,让模型在上下文窗口快满时打盹,反复咀嚼信息,压缩进长期权重。测试显示,增加“睡眠”轮次能提升深度推理表现。

量子位
新闻资讯7

首届AI交易赛落幕,6个AI炒币2周:Qwen、DeepSeek赚钱,GPT-5血亏6000刀

首届nof1 AI模型交易赛于2025年10月17日至11月3日举行,6款模型获1万美元初始资金自主炒币。结果Qwen3 Max、DeepSeek赚钱,GPT - 5等美国系模型幅亏损,币安创始人赵长鹏也对此发表看法。

机器之心
推荐文章7

AI Infra 工程师们如何应对模型流水线里的“暗涌”?

InfoQ《极客有约》X AICon 直播,邀请华为昇腾专家 ZOMI 酱、蚂蚁集团马介悦和 SGLang 尹良升探讨模型 Infra 工程师实战日常。涉及模型工程高频问题、版本迭代策略、推理部署优化、开源项目挑战等内容。

InfoQ