深度研究能力」共找到 5114 篇相关文章

算法论文8

超越对数似然:模型能力连续体下的监督微调新范式

论文挑战监督微调(SFT)用负对数似然(NLL)作训练目标的默认设定,提出基于概率的目标家族,引入“模型能力连续体”概念,分析不同目标在不同模型能力下的表现,为模型后训练提供新优化方向。

深度学习自然语言处理
算法论文8

SFT「不完全学习」之后,研究的下一个前沿在哪?ACL 2026 腾讯混元论文未来方向展望

本文从不完全学习现象出发,展望SFT领域未来研究方向,如未知根因探索、检测方法改进等,还提及推广到其他训练范式、CPT精细化研究等,给出研究优先级和社区建议。

InfoQ
新闻资讯7

GPT-5.4 发布,OpenClaw 要被替代?OpenAI 新模型会自己用电脑了,还顺手把编程能力拉满

今天,OpenAI 发布 GPT-5.4,将推理、编程和计算机使用能力整合,具备原生电脑操作能力,提升了工具使用效率。它成本降低、幻觉减少、编程能力更强,但 API 价格较高。其或与 OpenClaw 抢夺入口。

InfoQ
新闻资讯8

Nature发表、Science点赞!清华揭秘AI让科学家走捷径却让科学走窄路

清华大学基于超4100万篇论文研究发现,AI虽提升科学家个人产出与职业进程,却使科学探索领域变窄固化。研究发表于Nature,被Science深度报道,揭示了AI在科学发展中的利弊。

AIGC开放社区
算法论文7

剑桥揭开大模型翻车黑箱!别再怪它不懂推理,是行动出错了

剑桥大学等机构研究指出,大模型执行长时任务易翻车,问题不在推理而在执行能力研究人员评估多个指标,发现单步准确率提升可让任务长度指数增长,还研究了自条件化等影响及模型规模的作用。

新智元
推荐文章8

Google内部文档深度解析与AI模式用户行为研究

文章基于Google 2024年泄漏内容数据仓库逆向分析,解构其排名流程,解析核心指标与E - E - A - T,还介绍AI模式用户行为研究,为SEO提供启发与检查清单。

白杨SEO优化教程
产品应用8

登顶SuperCLUE DeepSearch,openPangu-R-72B深度搜索能力跃升

近日 SuperCLUE 发布 11 月 DeepSearch 评测报告,国产大模型 openPangu - R - 72B 名列第一。它采用 MoE 架构平衡效率与性能,经预训练技术优化和 DeepSearch 专项突破,彰显国产算力与大模型研发融合成效。

机器之心
算法论文7

Anthropic 最新的研究:AI 并未造成失业?

2026年3月5日,Anthropic发布经济研究文章,指出无明显证据证明AI已造成大规模失业。研究提出‘观测的暴露度’衡量维度,发现AI实际使用远低于理论能力,其替代工作进展比预期慢。

刘言飞语
算法论文7

告别Reasoning模型的“灵光一现”,推理能力可控了

当前GPT - 4o、DeepSeek - R1等大模型推理的‘高级操作’随机触发,不可控。研究者受经典推理三要素启发,教会模型三种‘元能力’,经三阶段训练,模型效果提升,让推理能力可控。

深度学习自然语言处理
新闻资讯7

Claude爆火研究漏引华人团队成果,已挨打立正道歉

Anthropic新论文研究Claude“情绪机制”,漏引华人团队Chenxi Wang去年10月论文。经沟通,A社已道歉并更新博客引用。华人团队论文首篇系统研究LLMs情绪机制,解答核心问题,成果显著。

量子位