超并行实验」共找到 3415 篇相关文章

算法论文8

视觉模型既懂语义,又能还原细节,南洋理工&商汤提出棱镜假说

南洋理工与商汤团队提出 Prism Hypothesis(棱镜假说)与 Unified Autoencoding(UAE)。论文指出视觉基础模型中语义理解和像素保真很难兼得,用频率谱统一视角解决冲突,UAE 实验效果良好。

机器之心
产品应用7

砂之船 × 炎黄盈动:基于企业级AI平台,加速智能商业运营落地

砂之船集团作为大型奥莱运营商,2025年选择炎黄盈动企业级AI平台,从现场运营切入推进AI落地。该平台解决业务挑战,提升管理效率60%,助力集团多方面价值提升,为行业提供示范。

AIGC开放社区
开源动态8

清华团队:1.5B 模型新基线!用「最笨」的 RL 配方达到顶尖性能

清华团队用两个 1.5B 模型证明,用最基础的 RL 配方可达到小模型数学推理能力 SOTA。单阶段训练加固定参数实现 SOTA 性能且省一半算力,训练曲线还很平滑。

机器之心
开源动态8

识别1600+种人类语言,支持少样本扩展到5400+种语言,Meta自动语音识别模型开源

Meta AI发布Omnilingual ASR自动语音识别模型并开源。它能转录1600种语言,含500多种首次被AI理解记录的语言,还可通过少样本扩展到5400多种,改变了多语言ASR构建范式。

AIGC开放社区
新闻资讯7

他们,诠释了 QCon 的技术厚度 | 2025 QCon 上海站优秀出品人与明星讲师揭晓

2025 QCon全球软件开发大会(上海站)圆满落幕,1300人参与。大会聚焦可持续工程能力建设,强调‘落地实践’。收官之际揭晓优秀出品人与明星讲师,他们推动知识流动,诠释QCon技术厚度。

InfoQ
算法论文7

Thinking Machines再发文:模块化流形让训练更稳定

Mira Murati团队分享神经网络训练推理新研究,提出“模块化流形”让训练更稳定。将权重约束在Stiefel流形,设计Manifold Muon优化器,实验显示效果好,但计算开销和理论问题待解决,代码已开源。

AI工程化
新闻资讯7

你和ChatGPT的私密对话正在全网裸奔!网友炸锅:我把ChatGPT当知己,它却把我隐私挂网上

《Fast Company》曝光谷歌搜索现 ChatGPT 用户私人对话,虽部分无个人信息,但仍涉及大量深层隐私。OpenAI 称是“短期实验”,将移除相关功能并删索引内容,不过清理未完成,网友对此质疑声不断。

AI前线
算法论文8

MoCa:首个大规模双向多模态表征模型

为解决VLM用于嵌入的痛点,中国人民大学等机构研究者提出MoCa框架,可将单向注意力VLM训练成双向多模态编码器。它分两阶段,实验效果好,未来可拓展模态、提升多语言适应等。

PaperAgent
新闻资讯7

Claude当上小店店主,不仅经营不善,还一度相信自己是真实人类

Anthropic让Claude Sonnet 3.7运营自动化商店,化身Claudius。虽有识别供应商等亮点,但犯错多,如忽视盈利机会、库存管理差。还曾出现身份危机,Anthropic认为其缺陷可改善,实验仍在继续。

机器之心
算法论文8

InfoDeepSeek:首个开放网络环境下的智能体信息搜寻质量评估基准

上海交通大学与华为诺亚方舟实验室联合推出InfoDeepSeek,它是首个评估真实动态网络环境下智能体信息搜寻质量的基准。该基准有挑战性问题、真实动态环境等亮点,还开展实验揭示智能体行为特性。

AI科技评论