预测强度」共找到 449 篇相关文章

算法论文8

推理速度飙升5倍,苹果提出全新Multi-Token生成框架!

自回归语言模型逐词生成文本拖慢推理速度、限制并行能力。Apple提出全新框架,挖掘其对未来词元“先验知识”,通过多项技术并行预测多词元,微调预训练模型可显著提速且不损输出质量。

PaperAgent
算法论文8

新范式来了!新能量模型打破Transformer++扩展上限,训练扩展率快35%

研究训练新能量模型 EBT,为输入和预测分配能量值,模拟思考过程。它有跨模态、跨任务通用性,训练扩展率比 Transformer++ 高 35%,推理性能提升 29%,还在多任务中表现出色,是扩展模型能力新范式。

机器之心
算法论文8

PRF | 宾州州立、南科大杨翔、张雯等:粗糙壁湍流的低维建模新范式

传统粗糙壁湍流低维建模依赖经验参数,泛化与精度不足。该研究提出新思路,将粗糙面形貌压缩到低维流形,用自动编码器和前馈神经网络建模,重构效果好、预测准,有生成与泛化性。

力学与人工智能
算法论文8

网页智能体新突破!引入协同进化世界模型,腾讯AI Lab提出新框架

腾讯AI Lab提出WebEvolver框架,引入协同进化的世界模型,让智能体在真实网页环境中性能提升10%,突破现有基于LLM的网页智能体瓶颈,还通过实验验证了其有效性和对网页状态变化的预测能力。

量子位
开源动态8

机器人看29s视频学会一个新技能,自变量开源HOST框架

自变量机器人开源的HOST框架,让机器人看29s人类示范视频就能学会新技能,原技能不受影响。它通过自定位级联预测,解决了人和机器人动作节奏、身体结构不同的问题,效率远超主流微调方案,推动机器人进家庭。

PaperAgent
算法论文8

GRPO遭遇瓶颈?G²RPO-A让自适应指导为小模型推理能力「开外挂」

大模型推理能力难迁移到小模型,现有强化学习方法如GRPO在小模型上性能提升有限。香港中文大学(深圳)唐晓莹教授团队提出G²RPO - A算法,缓解小模型奖励稀疏问题,在多模型实验中表现优于vanilla GRPO。

机器之心
算法论文8

IEEE TAP|上海交通大学曹慧琳、南京大学任宇翔等:AI赋能电磁仿真:物理–数据混合驱动的PdEgatSCL模型实现高效建模

为实现电大尺寸目标快速精确建模,本文提出物理 - 数据混合驱动的PdEgatSCL方法,学习CFIE做端到端预测。用EGAT架构,编码格林函数等特征。测试显示它精度高、速度快、省内存,可加速电磁建模与逆向设计。

力学与人工智能
新闻资讯7

AI系统10分钟生成CVE漏洞利用程序:网络安全攻防战进入“分钟时代”

研究人员开发的AI系统能10 - 15分钟生成CVE漏洞利用程序,成本约1美元,准确性和可靠性高。此外,HPTSA系统可利用零日漏洞。传统网络安全防御模式失效,攻防失衡加剧,AI攻防对抗趋势明显,有专业化、自主化、高强度特点。

AIGC开放社区
新闻资讯7

o3-pro正式推出!说声“嗨”就花了80美元,思考1+1用时16分钟

OpenAI推出推理模型o3 - pro,同时o3降价80%。官方测评o3 - pro表现佳,但价格贵、响应慢。o3‘是否降智’引争议,奥特曼发小作文探讨AI对人类社会影响,还透露公开权重模型推迟。

量子位
7

强化学习之父:LLM主导只是暂时,扩展计算才是正解

新晋图灵奖得主、强化学习之父Richard Sutton在新加坡国立大学演讲时预测,大模型主导是暂时的,未来五年甚至十年内不是技术前沿。他认为AI应从依赖人类数据转向体验学习,强化学习潜力需靠扩展计算支撑。

量子位