「架构升级」共找到 2565 篇相关文章
加入Meta近一年,亚历山大王回应:超级智能之前,AI终局未定
亚历山大·王加入Meta近一年后携Muse Spark模型回归,回应诸多争议。他指出Llama 4发展不符要求,Meta缺超级智能信仰。介绍了Meta超级智能实验室架构原则,还谈到算力分层、模型福利等内容。
GPT-5.5全球首破!0源码盲写程序,编程AI进入新纪元
全网AI交白卷的ProgramBench编程基准,被GPT-5.5首破。它能0源码盲写程序,同一题用C和Python两种解法通过测试。相比之下,Opus 4.7表现不佳。这揭示推理算力成编程AI核心变量。
ICLR最佳论文:Transformer天生简洁
2026年ICLR最佳论文对Transformer做深度思维体检,指出其架构真正威力在于描述概念时比RNN等简洁指数级甚至双重指数级,但验证其内部逻辑计算成本高昂,为解释其能力开新窗。
重磅并购!车规MCU赛道迎洗牌
4月28日,矽力杰发起的并购基金完成对云途半导体的控股收购。矽力杰专注模拟芯片,云途基于Arm架构。二者技术互补,此次收购补齐矽力杰短板,正值国产替代关键期,将推动车规芯片自主可控。
腾讯大模型动作慢了吗?姚顺雨带着Hy3 preview杀进第一梯队
国内大模型发展迅速,腾讯此前动作较慢。姚顺雨加入后推动变革,混元团队重建推出Hy3 preview,有295B总参数和快慢思考融合架构,开源且性能优,在多方面表现出色,成本下降。
DeepSeek-V4发布!高效百万上下文智能普惠时代来了
DeepSeek-V4发布,是开源社区关键分水岭。它解决超长文本处理效率痛点,架构与优化有多项突破,降低算力消耗和成本,适配国产芯片,性能比肩顶级闭源模型,推动开源社区两大未来趋势。
TPAMI 2026 | 北大彭宇新团队提出CPL++框架,实现视觉定位模型的「自知之明」和「自我纠错」
北大彭宇新教授团队提出CPL及进阶版CPL++框架。CPL用单模态匹配构造伪标签,引入静态验证模块;CPL++进一步自监督升级,具备纠错能力。实验显示,CPL++缩小了弱、全监督方法性能差距。
永别了,背公式时代!波兰物理学家用一个算子统一数学
2026年4月,波兰雅盖隆大学物理学家安杰伊·奥德尔齐沃莱克发表论文,提出算子eml(x,y) = eˣ − ln(y),证明不断嵌套此算子可推导出科学计算器上每个按键对应的函数,引发数学界震动。
实测参考生之王Vidu Q3:这已经不叫AI生成了,这叫AI驱动整个剧组
4月13日生数科技发布视频大模型Vidu Q3,在SuperClue榜单断层登顶。它从‘生成视频’转向‘驱动剧组’,升级后能嵌入内容生产流程,实现‘万物可参,声画同出’,在多赛道表现亮眼。
Meta发布Muse Spark,MSL的首份答卷!Alexandr Wang通过了吗?
Meta发布Muse Spark,是MSL首个模型,经九个月技术栈重构,效率优先。它有原生多模态推理能力,Contemplating模式处理复杂查询,安全评估突出,产品功能升级,商业化转向明显,正逐步在Meta应用推出。