「中科大」共找到 6834 篇相关文章
斯坦福人均≈0.1张GPU!学术界算力遭「屠杀」,LeCun急了
学术界GPU荒严重,美国顶尖大学人均GPU少,与大厂差距大。如斯坦福人均0.14张,而微软等大厂数据中心算力惊人。这导致人才流向工业界,学术验证能力弱,但部分高校有改善措施。
《生成式AI卓越架构设计指导原则》:从"能用AI"到"用好AI"
在2025云栖大会上,阿里云发布《生成式AI卓越架构设计指导原则》,以云原生“卓越架构五大支柱”为基础,针对大模型内容合规与安全治理等领域提建议,助力企业从‘能用AI’走向‘用好AI’。
6.1B打平40B Dense模型,蚂蚁开源最新MoE模型Ling-flash-2.0
蚂蚁百灵大模型团队开源 MoE 大模型 Ling-flash-2.0,其以轻量级配置展现卓越性能,在推理速度、任务性能、部署成本间找到新平衡,为大模型‘参数膨胀’提供新路径,还在多领域应用表现出色。
OpenAI夺金IOI,但输给3位中国高中生
OpenAI官宣其推理模型在今年IOI线上竞赛中成绩刷新纪录,总分533.29,全球330名人类选手中排第六,AI参赛者中居首。不过其没比过三位中国高中生。此前OpenAI称模型获IMO金牌引争议,此次网友更谨慎。
深度解读 DeepSeek V4.1 Flash 全新架构,如何成为显存杀手
本文深度解读DeepSeek最新发布的V4.1 Flash大模型,详解其全新CED架构与第二代压缩稀疏注意力CSA2,揭秘其通过架构创新大幅压缩KV缓存、降低显存算力成本,在长上下文Agent场景实现性能反超的细节。
突发,马斯克的SpaceX官宣将600亿美金收购Cursor
2026年开年,马斯克的SpaceX官宣600亿美金收购Cursor。Cursor在开发者圈表现出色,月活约700万,大企业渗透率高。SpaceX AI有算力,想借Cursor变现,未来或让程序员角色质变。
芯片企业突然官宣涨价!
1月27日,中微半导对MCU等产品涨价15% - 50%,称受供应紧张、成本上升影响。国科微也宣布自1月起对KGD产品调价,最高涨80%。国内半导体企业通过价格策略应对波动,深化布局与投入。
ACL 2026 | 别轻易给AI发「~」,它可能会删掉你的整个主目录
西安交通大学等校团队揭示大模型表情符号语义混淆安全漏洞,用自动化框架测试主流大模型,平均混淆率38.6%,多数混淆响应会“静默失败”,超半数达高危害级别。
HF Papers 直播 AI Insight Talk| Omni全模态专场
由多平台联合发起的【AI Insight Talk】系列直播活动第五场 - Omni全模态大模型专场于2025年11月18日10:00 - 12:00直播。多位全模态模型核心研发者将分享技术,还有圆桌对谈。
SRO架构赋予Qwen-2.5-VL推理能力,性能飙升16.8%
文本领域推理模型成就大,但扩展到多模态大语言模型遇阻力,如冷启动初始化不足等。为此提出 SRO 三阶段训练框架,经测试,ReVisual - R1 平均性能提升 16.8 个百分点。