「残差场预测」共找到 777 篇相关文章
用系统架构思维,告别“意大利面条式”系统提示词
本文作者分享编写系统级提示词经历,指出‘规则清单式’设计有规则打架、维护难、价值稀释问题。引入系统架构思维,构建四层设计框架,给出编译原则与模板,还重构‘AI编程助手’提示词,实现从‘规则管理者’到‘系统设计师’转变。
推理速度飙升5倍,苹果提出全新Multi-Token生成框架!
自回归语言模型逐词生成文本拖慢推理速度、限制并行能力。Apple提出全新框架,挖掘其对未来词元“先验知识”,通过多项技术并行预测多词元,微调预训练模型可显著提速且不损输出质量。
新范式来了!新能量模型打破Transformer++扩展上限,训练扩展率快35%
研究训练新能量模型 EBT,为输入和预测分配能量值,模拟思考过程。它有跨模态、跨任务通用性,训练扩展率比 Transformer++ 高 35%,推理性能提升 29%,还在多任务中表现出色,是扩展模型能力新范式。
PRF | 宾州州立、南科大杨翔、张雯等:粗糙壁湍流的低维建模新范式
传统粗糙壁湍流低维建模依赖经验参数,泛化与精度不足。该研究提出新思路,将粗糙面形貌压缩到低维流形,用自动编码器和前馈神经网络建模,重构效果好、预测准,有生成与泛化性。
网页智能体新突破!引入协同进化世界模型,腾讯AI Lab提出新框架
腾讯AI Lab提出WebEvolver框架,引入协同进化的世界模型,让智能体在真实网页环境中性能提升10%,突破现有基于LLM的网页智能体瓶颈,还通过实验验证了其有效性和对网页状态变化的预测能力。
机器人看29s视频学会一个新技能,自变量开源HOST框架
自变量机器人开源的HOST框架,让机器人看29s人类示范视频就能学会新技能,原技能不受影响。它通过自定位级联预测,解决了人和机器人动作节奏、身体结构不同的问题,效率远超主流微调方案,推动机器人进家庭。
Claude降智实锤了!还变相涨价,Opus跌下神坛
AMD高级总监审计发现Claude处理复杂任务能力变差,第三方跑分排名下降。官方称调整是为平衡速度与成本,但用户认为是变相降智。此外,企业包月套餐涨价,而Anthropic将推Opus 4.7和新设计工具。
Anthropic:警惕评测排行榜!差别可能只是机器的内存更大,而已
Anthropic发工程博客指出,AI编程评测排行榜上排名前列的模型分差小,而运行环境硬件配置能让分数波动6个百分点。同一模型在不同沙箱策略下分数不同,资源配置影响评测结果,排行榜分数差距或因硬件。
这些大神在Meta的论文看一篇少一篇了
田渊栋团队剖析可验证奖励强化学习(RLVR)训练动态,戳破参数更新稀疏误区,提出三门理论说明其参数更新定位机制,还为RL训练算法设计提供指导,指出SFT时代参数高效微调方法在RLVR中迁移效果差。
IEEE TAP|上海交通大学曹慧琳、南京大学任宇翔等:AI赋能电磁仿真:物理–数据混合驱动的PdEgatSCL模型实现高效建模
为实现电大尺寸目标快速精确建模,本文提出物理 - 数据混合驱动的PdEgatSCL方法,学习CFIE做端到端预测。用EGAT架构,编码格林函数等特征。测试显示它精度高、速度快、省内存,可加速电磁建模与逆向设计。