超并行实验」共找到 3415 篇相关文章

新闻资讯7

英伟达护城河又宽了!低调收购开源算力调度王牌工具,全球过半顶级算在用,Thinking Machines也离不开它

英伟达低调收购SchedMD,其为Slurm系统核心开发商,该系统被全球半数TOP500级计算机等使用。收购整合成本低、战略价值高,英伟达承诺保持Slurm开源,但相关项目开发受关注。此外,英伟达还推出Nemotron 3系列开源模型。

量子位
产品应用8

Anthropic新模型杀疯了!成本直降 2/3、性能直逼GPT-5,用户实测:比“吹”的还强,速度 Sonnet 3.5 倍

Anthropic发布Claude Haiku 4.5版本,成本降2/3、性能逼近GPT - 5,速度Sonnet 3.5倍。该模型已全平台上线,可处理大文件,安全对齐性佳。它能与Sonnet协同,适用于企业与软件开发,Anthropic业务也在爆发式增长。

InfoQ
算法论文8

拖拽视频编辑进入流式时代!任意时刻、任意内容,实时修改 | ICLR'26

新加坡南洋理工大学和合肥工业大学研究人员在ICLR 2026提出REVEL任务,打造免训练DragStream方法,实现视频生成时实时拖拽编辑,支持多种操作,破解两大难题,实验显示效果、泛化性佳。

新智元
新闻资讯7

谷歌看了都沉默:自家「黑科技」火了,但为啥研发团队一无所知?

当科技圈为‘谷歌黑魔法’兴奋时,所谓‘并行验证循环’可能是AI生成的‘赛博跳大神’。它号称越思维链,性能提升显著,但发帖者身份存疑,无可靠源链接,其真实性遭业内质疑。

新智元
算法论文8

RL训练一层就够了!单层RL越全参数训练,跨任务跨模型跨算法全部验证

明尼苏达大学、北大和亚马逊团队研究发现,RL收益集中在中间层,训练单层可全参数训练。他们提出层贡献度指标,经多模型、算法、任务实验验证,还给出三种训练优化策略。

机器之心
算法论文8

ACL 2025 | 让小说角色 「活」起来!复旦BookWorld打造沉浸式小说世界模拟系统

复旦大学团队主导的BookWorld系统,是ACL 2025论文成果。它能从小说提取数据构建AI世界,让角色AI互动创作故事。系统有自主和干预模式,实验表现出色,未来可成互动娱乐平台。

机器之心
算法论文7

Transformer与RNN合体,谷歌打下显存门槛,解锁长上下文

谷歌论文提出 Memory Caching 技术,通过架构机制创新赋予 RNN「可生长的记忆容量」,兼顾 Transformer 与 RNN 优势,能处理更长文本、降低推理资源门槛,实验显示有良好效果。

机器之心
产品应用8

把PLC仿真搬进浏览器,小参数模型也能实现高工程通过率

上海交通大学联合Sema研究团队推出SemaPLC,将AI Agent与PLC工程工具链连接,让自然语言需求转化为可编译、验证、仿真的控制程序。它是面向全流程的智能工作台,实验效果优于业界方案。

量子位
算法论文7

外国科学家从汉字中找到了设计强材料的灵感!“天”字形材料最坚固

4月21日爱丁堡大学研究人员在《应用物理学杂志》发文,将“人”“大”“天”“夫”字形转化为材料结构单元,经压缩实验发现汉字字形中藏力学规律,“天”字形材料性能最优。

DeepTech深科技
算法论文8

图像分词器造反了!华为 Selftok:自回归内核完美统一扩散模型,触发像素自主推理

华为盘古多模态生成团队推出 Selftok 技术,通过反向扩散将自回归先验融入视觉 token。它突破传统,实现因果 token、强化学习友好型 token 及纯 AR 大一统架构,实验在多方面表现优异,论文还入选 CVPR 2025 最佳候选。

机器之心