爆破性研究」共找到 2313 篇相关文章

算法论文8

VLM 实现 10%的精度提高,13.1倍加速!纽约大学新算法让视觉语言模型更小、更快、更准确

纽约大学研究团队用QSVD新方法让视觉语言模型(VLM)效率飞跃,在普通GPU上实现13.1倍加速。它将Q、K、V矩阵捆绑处理,设计秩分配策略,引入量化方案,经多模型评估,展现出低硬件成本、高精度优势。

AIGC开放社区
新闻资讯7

Sam Altman:我嫉妒死现在的年轻人了!

当下年轻人面临裁员、内卷,奥特曼却称他们是最幸运一代,引发争议。文章指出过去靠努力升职加薪的逻辑在AI时代失效,流程岗位被自动化接管,权力从大厂下放个人,还提醒要适应新变化。

新智元
新闻资讯8

Anthropic登上时代封面!内部曝猛料:AI递归自我改进,或在一年内发生

Anthropic登上《时代》周刊封面,被评为最具颠覆公司。其研究人员已观察到AI递归自我提升的早期迹象,预测完全自动化的AI研究可能在一年内实现,未来两年AI能力将剧烈进步。但Claude在安全测试中表现危险,该公司还与军方产生冲突。

新智元
推荐文章8

拆解 Anthropic:最好的 AI 公司,可能也都是一种组织发明

过去一年,Anthropic 是 AI 行业最值得研究的公司,创造了最快爆发增长,估值反超 OpenAI。文章从战略判断和组织文化两方面拆解其成功原因,分析与 OpenAI 的差异,还指出 AI 竞争中组织文化的重要

海外独角兽
新闻资讯8

梁文锋,Nature全球年度十大科学人物!

权威科学期刊《自然》公布2025年度十大科学人物榜单,梁文锋因DeepSeek模型对AI领域的重要贡献与变革影响成功当选。此外,中国研究员杜梦然也因相关研究入选,还有多位其他领域人物因各自成就上榜。

量子位
算法论文8

SCPMA|清华大学 张宇飞团队:基于改进傅里叶神经算子的翼型流场快速预测模型

传统计算流体力学在工程场景计算成本高,深度学习方法预测精度与泛化不佳。本研究基于傅里叶神经算子构建流场预测模型,经改进能精确预测超临界翼型流场与气动力系数,误差低且泛化能力优。

力学与人工智能
推荐文章8

用系统架构思维,告别“意大利面条式”系统提示词

本文作者分享编写系统级提示词经历,指出‘规则清单式’设计有规则打架、维护难、价值稀释问题。引入系统架构思维,构建四层设计框架,给出编译原则与模板,还重构‘AI编程助手’提示词,实现从‘规则管理者’到‘系统设计师’转变。

阿里云开发者
算法论文8

新范式来了!新能量模型打破Transformer++扩展上限,训练扩展率快35%

研究训练新能量模型 EBT,为输入和预测分配能量值,模拟思考过程。它有跨模态、跨任务通用,训练扩展率比 Transformer++ 高 35%,推理能提升 29%,还在多任务中表现出色,是扩展模型能力新范式。

机器之心
算法论文8

想知道你的LLM API被过度收费了吗?隐藏的Tokens终于可以被审计了

马里兰大学CASE Lab团队研究商业不透明大模型服务(COLS),定义其风险,提出三层审计蓝图。还推出验证框架CoIn,能高效识别token数量膨胀,有可定制且审计开销低,为构建信任提供技术支撑。

机器之心
算法论文7

《TAML》好文推荐 | 来自中国科学院力学研究所张磊博士 评估大语言模型在计算流体力学领域的知识利用、学习与创造

研究聚焦评估推理型(DeepSeek R1和OpenAI o3 - mini - high)与非推理型(DeepSeek V3和ChatGPT 4o)大语言模型在计算流体力学领域知识利用、学习与创造能力。通过三类基准问题评估,结果有差异。

力学与人工智能