小参数量模型」共找到 8276 篇相关文章

算法论文7

中国科学SCPMA | 南科大王建春团队:基于改进隐式轴向分解Transformer的三维槽道湍流快速预测

南科大王建春团队改进IFactFormer模型,采用“并行”轴向分解注意力机制,提升在复杂流动问题中的表征能力和稳定性。实验显示,改进模型拟合与长期预测能力强,多数指标精度优于传统方法。

力学与人工智能
新闻资讯8

碾压扎!22岁成亿万富翁,2025年AI造富速度刷新人类认知

2025年AI成超级造富机,将50多位创始人送入亿万富翁俱乐部。从大模型到应用层,AI渗透生活。巨额融资不断,巨头砸钱建基建,人才争夺激烈,多模态初创公司也受青睐,职场AI使用比例上升。

新智元
技术文章8

加一个JVM参数,让系统可用率从95%提高到99.995%

文章针对高并发系统不稳定问题,定位是系统内存索引切换时 GC 压力大所致。围绕让索引尽早晋升、直接分配到老年代等思路探索优化,经多番尝试,最终实现索引无感切换,使系统可用率达 99.995%。

阿里云开发者
算法论文8

中山大学梁丹团队论文:让视频生成从「看起来真实」到「物理上正确」丨CVPR 2026

中山大学梁丹团队提出《ProPhy: Progressive Physical Alignment for Dynamic World Simulation》,通过分层建模和逐步对齐,引入视觉语言模型作监督,解决视频生成模型物理建模问题,提升物理正确性和视频质量。

AI科技评论
算法论文8

ICLR 2026 | ESC — 解构一步生成,厘清细节,探寻本质

西湖大学研究人员针对一步扩散生成模型复杂性问题,提出统一设计框架,对代表性模型进行组件级分析,定位关键误差来源,提出ESC变体,在ImageNet 256×256上取得优异成果。

机器之心
新闻资讯7

评审用不用AI,作者说了算?ICML 2026全新评审政策出炉

ICML 2026 引入评审类型选择机制,作者可决定评审是否用大语言模型。政策 A 禁止,政策 B 允许但有限制。不过大模型使用规定执行难,此规则更像约定。

机器之心
新闻资讯8

Anthropic 研究发现:仅需少量污染文档即可对 LLM 实施投毒

Anthropic的Alignment Science团队研究大语言模型训练投毒攻击,实验发现仅250条恶意样本就能植入“后门”,且模型越大攻击越易,还对微调数据集实验,引发讨论。

InfoQ
开源动态8

世界模型+强化学习=具身智能性能翻倍!清华&加州伯克利最新开源

具身智能发展中样本效率成瓶颈,传统无模型强化学习依赖盲目试错。清华与加州伯克利团队提出BOOM框架,通过自举循环机制解决在线规划与策略学习矛盾,实验表现卓越,为具身智能落地提供支撑。

量子位
新闻资讯7

烧光600亿,扎再砍元宇宙1500人!6000亿豪赌算力帝国

Meta计划裁减Reality Labs 10%员工,约1500人,元宇宙相关岗位首当其冲。自2020年起,Meta在元宇宙投入超600亿美元却未形成稳定收入。同时,Meta推出绩效改革,顶尖员工最高拿300%奖金,还官宣千亿豪赌算力帝国。

新智元
8

AI教父Geoffrey Hinton,全球第二个百万引用科学家!

AI教父Geoffrey Hinton论文被引数破百万,成全球第二人。其代表作如AlexNet、Deep Learning等影响深远,覆盖理论、技巧等层面,支撑大模型运行。他还称大模型是黑箱,领域待探索。

新智元