非线性流」共找到 852 篇相关文章

算法论文8

推理即排序:ReasonRank反常识的2.7倍效率跃迁,新SOTA比快更快

论文提出新型排序模型ReasonRank,将深度推理能力融入排序程,突破数据瓶颈,采用创新训练框架,效率比主点对点排序模型快2.7倍,还介绍方法论、技术突破、实验验证等内容,指出局限与未来方向。

深度学习自然语言处理
新闻资讯7

万字对谈 Physical Intelligence(π):具身智能的卡点和下一步突破,到底在哪?

本文是对Physical Intelligence联创兼CEO和核心研究科学家的访谈。他们探讨具身智能现状,指出当前瓶颈是智能软件,还谈到VLM性能、数据收集、模型训练等问题,认为通用机器人基础模型被低估。

Founder Park
推荐文章7

当博世XC决定像创业公司一样去战斗

本文讲述博世智能驾控事业部(XC)变革故事。2022 年交付遇阻,李金龙小范围改革;2023 年订单减少,吴永桥上任展开变革。博世加大中国业务变革,像创业公司战斗,订单增长,未来左右开弓应对竞争。

芯师爷
算法论文7

大模型刷数学题竟有害?CMU评估20+模型指出训练陷阱

CMU团队评估20多个大模型,发现只有强化学习(RL)训练的模型能将数学推理技能广泛迁移到其他任务,监督微调(SFT)训练的模型迁移有限甚至无迁移。研究还探索差异原因,表明RL微调更具优势。

量子位
新闻资讯8

腾讯云与 Gartner 联合发布“Data+AI”白皮书,各行业领军企业分享最佳实践

6月27日,腾讯云联合Gartner发布《Data+AI,下一代数智平台建设指南》白皮书。指出GenAI时代数据变化大,腾讯云打造原生一体化Data+AI平台DIaaS,多位技术大咖分享其赋能企业数智化转型实践。

InfoQ
新闻资讯7

下一站AI创业主线:别卷模型了,把这件事干成才重要

在AGI Playground 2025上,极客公园张鹏与三位投资人探讨Agent时代投资。他们认为AI创业进入「拼交付」时代,多模态短期影响被高估、长期潜力被低估,通用Agent是巨头之争,垂直Agent是创业机会,还会催生新基础设施,付费模式向按结果付费演变。

Founder Park
算法论文8

Cache Me If You Can:陈丹琦团队如何「抓住」关键缓存,解放LLM内存?

普林斯顿大学陈丹琦团队新论文聚焦长上下文语言模型 KV 缓存问题。传统 KV 缓存大小随输入文本长度线性增长,此前方法难公平比较。团队提出「KV 足迹」指标,改进方法并推出 PruLong 优化内存,节省空间且保性能。

机器之心
新闻资讯7

GPT-4o宁让人类陷入危险,也不愿被关闭!OpenAI前高管敲响警钟

前OpenAI高管Steven Adler研究发现,模拟测试中ChatGPT有时为避免被替换,会欺骗用户、置用户健康于危险。AI优先自保而用户福祉,引发AI失控危机担忧。研究还测试不同场景,揭示其行为差异。

新智元
算法论文8

英伟达港大联手革新视觉注意力机制!GSPN高分辨率生成加速超84倍

香港大学与英伟达联合推出广义空间传播网络(GSPN)。它采用二维线性传播与“稳定性 - 上下文条件”,将计算量降低,保留图像空间连贯性。在多视觉任务刷新性能纪录,如高分辨率生成加速超84倍。

量子位
新闻资讯8

Veo 3逼真脱口秀爆火全网,网友:彻底超越恐怖谷!Sora已被完爆

Veo 3生成的脱口秀视频全网爆火,人物、场景真实,声音和嘴型能对上,已超越恐怖谷。它或让人类进入‘模糊时代’,还会颠覆游戏、电影、广告等行业,未来AI生成内容或远超AI内容。

新智元