对话式行为」共找到 1376 篇相关文章

新闻资讯8

OpenAI新模型GPT-5.1发布,不跑分不刷榜,主打一个说人话

OpenAI发布GPT-5.1,主打更智能、更具对话性,无跑分打榜,有人设说人话。包括Instant和Thinking两个子模型,简单问题快,复杂问题智能。本周逐步向用户免费开放,还更新了语气风格等功能。

量子位
开源动态8

NeurIPS 2025 | 中科大、港中深、通义千问联合发布CoRT:仅30个样本教会大模型高效推理,token消耗降低50%

大型推理模型在精确数学计算上存在问题,如认知冲突、行为低效、数据稀缺。中科大、港中深、通义千问联合推出CoRT框架,用创新数据合成与多阶段训练,提升模型推理能力和效率,成果已开源。

机器之心
算法论文8

用「进化+压力测试」自动生成的竞赛级编程题,各家大模型谁更hold住?

北京大学与通用人工智能研究院联合提出 UniCode 框架,构建进化评测系统,能自动生成高质量算法题目与抗污染测试用例。通过对 19 个前沿大模型测试,展现高挑战性与强判别力,为代码能力评估开辟新路径。

机器之心
算法论文8

NeurIPS 2025 Spotlight | 让检索、推理真正「合体」的小而强模型,AceSearcher来了

近期,多所高校研究团队发布 AceSearcher 模型,它是让同一语言模型在推理时兼任双角色的合作自博弈框架,以两阶段训练为骨架,将推理与检索结合,提升复杂检索任务效果,在多任务上表现出色。

机器之心
推荐文章7

晶圆级芯片主流技术路径对比

人工智能时代算力需求爆炸增长,与半导体工艺进步放缓矛盾凸显。晶圆级计算为算力发展开辟新路径,有Cerebras和特斯拉两种技术路线,邬江兴院士团队提出软件定义晶上系统技术,但我国该技术发展面临多重挑战。

芯师爷
新闻资讯7

Sam Altman:大的要来了

本文分享Sam Altman最新采访核心要点,解读OpenAI战略。谈及疯狂搞基建原因、发展方向、ChatGPT接入APP模及Sora成功启发,认为未来12 - 18个月AI需求或爆发。

newtype AI
推荐文章7

Andrej Karpathy深度解读:强化学习之父为何说大模型违背了「苦涩教训」

Andrej Karpathy深度解读Sutton与Dwarkesh的播客对话。Sutton认为大模型不符合「苦涩教训」,因其训练依赖人类数据集。他追求类似动物通过强化学习与世界交互的系统。Karpathy认可批评,认为找到符合原则算法是突破。

AGI Hunt
算法论文8

腾讯提出“我思故我玩”Agent:LLM构建推理与规划世界模型

腾讯与武大联合发表论文提出 CEL 新型 Agent 架构,通过 LLM 驱动两阶段循环实现“思考学习”。它能填补传统方法短板,在小游戏实验中表现出色,有可解释性等优势,但也有实验环境局限等问题。

深度学习自然语言处理
推荐文章8

【万字长文】大模型训练推理和性能优化算法总结和实践

本文总结大模型落地的训练、推理和性能优化算法与实践,介绍语言模型发展,对比BERT、GPT等训练方,分析生成大模型问题,还阐述数据处理、推理优化及训练调优等内容,并给出不同场景技术选型建议。

阿里云开发者
算法论文8

AI里最大的Bug,却也是人类文明最伟大的起点。

OpenAI论文指出AI产生幻觉是因其训练方奖励瞎蒙行为。以考试为例,AI在信息不足时猜测是最优策略。还从统计学解释根源,指出解决幻觉需改变评估指标,也引发对人类想象力起源的思考。

数字生命卡兹克