国科大」共找到 5061 篇相关文章

新闻资讯8

中兴星云拿下推理总分榜一!SuperCLUE 5月成绩出炉

2025年全球AI模型竞赛激烈,SuperCLUE发布5月报告,中兴通讯星云模型Nebula Coder - V6推理专项榜单总分并列第一、总榜并列第二,细分赛道表现佳,且是少数获国家级权威安全认证的模型。

新智元
产品应用8

传统云还在「卖铁」,下一代云已在「炼钢」:火山引擎xLLM如何一张卡榨出两张的性能!

模型上线部署时推理成本高、算力投入但效果不成正比,企业面临推理效率难题。火山引擎 xLLM 语言模型推理框架性能极致,成本低,集成关键创新,还被集成到 AI 云原生推理套件 ServingKit 中。

机器之心
新闻资讯7

养虾人狂吃国产模型!4.19万亿Token调用量激增34.9%超越美国

根据OpenRouter数据,上周中国模型周调用总量飙升至4.19万亿Token,再度超越美国登顶全球。中国产品在全球模型调用量Top 5中占三席,国产模型受青睐,但在速度和价格方面仍待提升。

量子位
产品应用8

《生成式AI卓越架构设计指导原则》:从"能用AI"到"用好AI"

在2025云栖会上,阿里云发布《生成式AI卓越架构设计指导原则》,以云原生“卓越架构五支柱”为基础,针对模型内容合规与安全治理等领域提建议,助力企业从‘能用AI’走向‘用好AI’。

阿里云开发者
开源动态8

6.1B打平40B Dense模型,蚂蚁开源最新MoE模型Ling-flash-2.0

蚂蚁百灵模型团队开源 MoE 模型 Ling-flash-2.0,其以轻量级配置展现卓越性能,在推理速度、任务性能、部署成本间找到新平衡,为模型‘参数膨胀’提供新路径,还在多领域应用表现出色。

机器之心
产品应用9

深度解读 DeepSeek V4.1 Flash 全新架构,如何成为显存杀手

本文深度解读DeepSeek最新发布的V4.1 Flash模型,详解其全新CED架构与第二代压缩稀疏注意力CSA2,揭秘其通过架构创新幅压缩KV缓存、降低显存算力成本,在长上下文Agent场景实现性能反超的细节。

AI科技评论
新闻资讯7

突发,马斯克的SpaceX官宣将600亿美金收购Cursor

2026年开年,马斯克的SpaceX官宣600亿美金收购Cursor。Cursor在开发者圈表现出色,月活约700万,企业渗透率高。SpaceX AI有算力,想借Cursor变现,未来或让程序员角色质变。

开源AI项目落地
算法论文8

ACL 2026 | 别轻易给AI发「~」,它可能会删掉你的整个主目录

西安交通学等校团队揭示模型表情符号语义混淆安全漏洞,用自动化框架测试主流模型,平均混淆率38.6%,多数混淆响应会“静默失败”,超半数达高危害级别。

机器之心
新闻资讯7

HF Papers 直播 AI Insight Talk| Omni全模态专场

由多平台联合发起的【AI Insight Talk】系列直播活动第五场 - Omni全模态模型专场于2025年11月18日10:00 - 12:00直播。多位全模态模型核心研发者将分享技术,还有圆桌对谈。

Hugging Face
算法论文7

SRO架构赋予Qwen-2.5-VL推理能力,性能飙升16.8%

文本领域推理模型成就,但扩展到多模态语言模型遇阻力,如冷启动初始化不足等。为此提出 SRO 三阶段训练框架,经测试,ReVisual - R1 平均性能提升 16.8 个百分点。

CourseAI