「能力成熟度框架」共找到 4536 篇相关文章
拒绝不必要Think:微软&北大提出第一种自适应大型混合推理模型
大型推理模型冗长思考开销大,微软研究院和北大提出大型混合推理模型(LHRMs),它能依查询上下文决定是否思考。介绍了两阶段训练流程、评估指标,实验显示其超越现有模型且效率高。
史诗时刻!AlphaGo神之一手突现,谷歌AI颠覆科研极限?
谷歌DeepMind推出AlphaEvolve,它取得多项数学成果,如改进4x4矩阵乘法、推进六边形填充问题研究等。它能自我进化,还可优化谷歌计算基础设施,预示人类与AI强大协作循环的未来。
北大校友,OpenAI前安全副总裁Lilian Weng最新万字博客文章:Why We Think
北大校友Lilian Weng新发布万字博文《Why We Think》,系统梳理让AI模型‘多想一会儿’的前沿方法及逻辑,深入剖析多种机制突破AI性能瓶颈的理论、技术与进展,还提出一系列待解决的开放性问题。
GPT-6数学封神,遭顶尖数学家公开质疑“算力截胡”?OpenAI内部研究员撕开Astra真相:人脑更容易被污染,而AI只看概率
OpenAI推出GPT-6 Astra,接连在埃尔德什单位距离猜想、纳维-斯托克斯方程等多个顶级数学难题上取得突破性进展,引发顶尖数学家对学术伦理与传统研究模式的争议,本文为OpenAI内部研究员的深度对谈编译,拆解AI数学推理的核心逻辑。
关于GPT-6 Astra的三条判断|甲子光年
北京时间9月4日凌晨,OpenAI发布GPT-6 Astra,演示其多种能力。「甲子光年」判断:GUI没消亡,是软件兼容层;Astra会“吞噬”App入口;传统Benchmark难描述Agent,任务闭环成关键。
解码提速15.1倍、多任务性能不降:复旦&引望WAM-Diff2打通自动驾驶VLA自回归—扩散转换
视觉-语言-动作(VLA)模型是端到端自动驾驶主流技术,但自回归解码架构有瓶颈。复旦大学与引望智能联合提出WAM-Diff2,实现自回归VLA向离散扩散模型迁移,解码加速15.1倍,多任务性能不降。
开发边界消失是必然,但 AI 没有替代开发者!对话 Google 全球开发者生态总监 David McLaughlin
文章是对 Google 全球开发者生态总监 David McLaughlin 的访谈。谈到 AI 会让开发边界消失,开发者应转变思维,AI 增强而非替代开发者,还探讨了谷歌工具策略、开发者出海问题、Token 管理等。
本周 5 个火火火的Github开源项目,每个都很有说法!
本周介绍5个Github开源项目。ai - berkshire将投资大师方法论系统化;stremio - web聚合视频资源;archify能将大白话描述变成架构图;Maple - font是优化的编程字体;Netcatty整合SSH客户端等功能。
Linux 基金会推出 Akrites 项目,防护核心开源软件免受 AI 网络威胁侵害
Linux 基金会发起 Akrites 项目,获超 20 家机构支持,旨在保护关键开源软件免受 AI 网络威胁。它建立协调框架,改进漏洞处理方式,补充现有工作,反映网络安全理念转变。
所有Harness终将长成“龙虾”,但最后活下来的只有几只
在用户需求驱动下,工具从 LLM 向 Agent、Harness 再到 Claw 自然进化,但用户能容纳的 Claw 有限。Sam Bhagwat 拆解进化路径,指出各阶段核心竞争力,开发者应抢占用户心智空间。