新能安」共找到 7771 篇相关文章

新闻资讯7

从润建、软通、华三等头部服务商,看IT巨头AI转型的共识|甲子光年

文章以润建股份为例,探讨传统 IT 服务商 AI 转型。润建以“曲尺”平台为支点转型,其平台覆盖全流程,“曲尺运维大模型”赋运维。此外,软通动力、华三也有类似转型,均结合自身优势掌握主动权。

甲子光年
新闻资讯7

传Claude sonnet 5即将发布:自动组建开发团队,一人即一公司,价格爆降50%

小道消息称Anthropic下一代AI模型Claude Sonnet 5或于北美时间2月3号发布,代号“耳廓狐”。它有全化身虚拟开发团队,编程力强,价格将降50%,还与谷歌深度合作。

AI寒武纪
开源动态7

推理成本骤降75%!gpt-oss用数据类型实现4倍推理速度,80GB显卡跑1200亿参数大模型

OpenAI在gpt - oss开源模型采用MXFP4数据类型,使推理成本降75%,内存占用为BF16模型四分之一,生成token速度提4倍,还降低硬件资源需求。不过MXFP4也有缺陷,英伟达推出NVFP4提升质量。

量子位
算法论文8

ICML spotlight | 一种会「进化」的合成数据!无需上传隐私,也生成高质量垂域数据

大模型发展使数据短缺问题加剧,特殊领域更严重。为此提出合成数据自主进化框架PCEvolve,只需少量标注样本,就在保护隐私同时进化出数据集,还介绍了其架构、选择器设计及实验结果。

机器之心
算法论文8

谁说Scaling Law到头了?研究:每一步的微小提升会带来指数级增长

很多人质疑扩大计算规模训练模型的做法,因Scaling Law面临收益递减。但研究发现,模型单步准确率的微小提升使完成任务长度指数级增长,还探讨了长程执行力的衡量及影响因素。

机器之心
算法论文8

模型合体!上交&上海AI Lab&华师提出LED-Merging,拒绝「力」与「全」二选一

上海人工智实验室等团队提出LED - Merging解决模型融合“全 - 效用冲突”问题。该方法无需训练,像“神经元手术刀”,不牺牲专业力还提升全性,论文已被ACL 2025 Main Conference接收。

深度学习自然语言处理
算法论文8

阿里通义发布并行计算策略:1.6B等效4.4B,内存消耗骤降95%

阿里通义团队提出PARSCALE并行计算策略,受CFG双路径推理机制启发,将并行思想扩展到训练和推理全流程。让1.6B模型性接近4.4B模型,内存占用大降,还可用于现有模型,无需从头训练。

量子位
开源动态8

社区发布丨全面开源!商汤日日SenseNova U1发布,迈向模型理解生成统一时代

商汤科技正式发布并开源商汤日日SenseNova U1系列原生理解生成统一模型,基于NEO - unify架构,实现模态集成向原生统一跨越,其轻量版在多项测试达同量级开源SOTA,还连续性图文创作。

Hugging Face
算法论文7

DeepSeek-R1推理智从哪儿来?谷歌研究:模型内心多个角色吵翻了

过去两年大模型推理力跃迁,谷歌等机构研究指出,推理力提升源于模型推理时隐式模拟类多智体交互结构“思维社会”,还提出利用“群体智慧”方向,并介绍了研究方法、实验结果等。

AINLPer
算法论文8

CVPR 2025 Oral | DiffFNO:傅里叶神经算子助力扩散,开启任意尺度超分辨率篇章

本文由圣路易斯华盛顿大学与北京大学联合完成,提出DiffFNO以神经算子赋扩散架构,支持高质、高效、任意连续倍率超分,介绍其核心思路、组件及优势,在多数据集上领先SOTA方法,为超分提供思路,适用于多领域。

机器之心