「研究能力」共找到 4714 篇相关文章
谷歌Gemini 2.5全线爆发!勇战「濒死恐慌」,却被丝血宝可梦吓到当场宕机
谷歌旗舰Gemini 2.5全家桶三款模型昨夜上线,包括正式版2.5 Pro、2.5 Flash及预览版2.5 Flash - Lite。技术报告显示其性能提升显著,还在玩宝可梦时惊现类人恐慌,推理性能下降。
Harness已过时,OpenAI、腾讯在搞下一个AI爆点RSI
本文解读Theseus Labs发布的RSI行业分析报告,该报告汇总全球72家头部AI团队公开资料,提出RSI五级自主权框架与HCI评估指标,梳理大厂进展与产业落地实践。
ICLR 2026 oral | AI代码真能进生产环境?SwingArena:从「写对代码Commit」到「通过CI审查」
过去一年大模型写代码能力提升,人们思考其能否参与软件工程核心流程。现有评测基准有缺失,SwingArena填补空白,将博弈引入评测,设计检索增强流水线,其开源后或成评估AI编程能力新工具。
股价暴涨32%!GLM-5登顶全球开源第一,25分钟一镜到底搓出完整系统
2026年初,智谱GLM - 5上线,它是全球首个在系统级工程能力上与硅谷巨头正面竞争的开源模型,发布后智谱股价暴涨32%。它能力惊艳,能完成复杂项目,成本可控,还适配国产算力。
LLM内部竟藏着众多策略模型?自所&腾讯团队首次揭示大模型RL新机制
中国科学院自动化研究所与腾讯AI Lab团队从可解释性分析出发,发现LLM内部含多个可采样内部策略,揭示不同模型推理熵模式,提出BuPO算法,在复杂推理任务上性能显著优于传统算法。
庞若鸣还有苹果论文?改善预训练高质量数据枯竭困境
苹果基础模型原负责人庞若鸣在 Meta 任职期间,其在苹果参与的高价值研究仍不断发表。研究团队针对大模型训练中高质量数据枯竭问题,提出 Synthetic Bootstrapped Pretraining (SBP) 预训练流程,提升模型性能。
享年101岁!AI之父明斯基的「反对者」走了,一生都在寻找另一种AI
8月10日,AI先驱Warren Brodey逝世,享年101岁。他曾将控制论用于家庭研究,后赴MIT研究AI。他不赞同Minsky的AI路径,倡导以技术增强人类潜能,还开发「软建筑」等,对AI前景谨慎乐观。
写顶会LaTeX论文的门槛彻底被谷歌PaperOrchestra打下来了~
谷歌推出多智能体协作框架PaperOrchestra,能将非结构化研究素材转化为符合顶会要求的LaTeX投稿论文。它解决了现有自动化研究框架在论文写作环节的问题,实验显示全面超越现有基线。
顶级程序员Andrej Karpathy发文表示已服软!
顶级程序员Andrej Karpathy发文称,从11月到12月其编程工作流剧变,从80%手动+20%AI辅助变为80%AI编程+20%人工修改。他记录用Claude Code编程观察,指出AI有新毛病但提升大,还给出使用技巧等。
清华AI数学家系统攻克均匀化理论难题!人机协同完成17页严谨证明
清华大学科研团队用自主研发的AI数学家系统(AIM),以人机交互模式解决均匀化理论研究问题,形成约17页证明。研究系统性总结五大高效人机交互模式,在三方面取得突破,还提出未来研究方向。