「闭源厂商」共找到 420 篇相关文章
无需训练的LLM对齐方法综述
大型语言模型应用引发担忧,传统微调方法有短板,免训练对齐(TF Alignment)应运而生。本文是首篇系统综述TF对齐技术的论文,提出三阶段分类框架,实验显示TF方法优势明显,还指明未来研究方向。
上海又要冲出一个百亿芯片IPO
近日,瀚博半导体与中信证券签署上市辅导协议,冲刺A股科创板。其由前AMD核心技术领袖钱军、张磊创立,选差异化技术路径,已历6轮融资。当前国产GPU IPO潮起,瀚博有望借此抢占市场。
几毛钱的芯片,利润直追英伟达
苹果曾被小小基带芯片困扰,芯片世界里有很多单价低、工艺要求不高的“小玩意”,但其利润却直追英伟达。如英飞凌、博通,它们靠“人脉”和网络效应赚钱,且所在领域不卷,抱着铁饭碗。
大模型首次直接理解代码图:不用Agent自动修bug,登顶SWE-Bench开源模型榜单
蚂蚁开源新模型CGM,首创将仓库代码图模态融入大模型,不依赖闭源模型和复杂Agent,仅需4步就能快速定位、生成补丁。它在多个测试基准中领先,技术论文等均已开源。
谷歌推出Googlebook:为Gemini重新造一台笔记本
谷歌宣布推出全新笔记本产品线Googlebook,专为Gemini AI打造。它融合Android和ChromeOS体系,有Magic Pointer等新功能,与Android手机协作顺畅,还新增Quick Access功能,首批设备由多厂商合作生产,今年秋季发布。
当前的上下文方案,本质是暴力破解!DeepMind 创始人:忽强忽弱的 AI,才是真正的灾难,突破在记忆系统
在播客《20VC》中,谷歌 DeepMind 创始人德米斯·哈萨比斯与主持人探讨 AI 未来。他认为 AGI 五年内大概率实现,规模和速度超工业革命;算力是瓶颈,软件记忆系统等突破也重要;还谈及开源、监管、能源等问题。
开源模型首超Opus4.6!智谱GLM-5.1登场,14小时后CUDA专家被冲了
智谱开源模型GLM - 5.1带来重大突破,14小时完成CUDA Kernel优化,加速比大幅提升。它解锁与顶尖闭源模型Claude Opus 4.6全面对齐,在多测试中表现优异,展现长程任务能力,改写行业叙事逻辑。
The Batch: 930 | DeepSeek 放弃 Nvidia 转向华为
中国开源权重模型开发者 DeepSeek 在 DeepSeek-V4 最新更新中未给美国芯片厂商适配机会,却向华为提供预发布版。美国限制出口芯片反促中国发展本土芯片,该决定加深中美 AI 生态分裂。
英伟达亲手终结CUDA「护城河」?传奇芯片架构师引发争议
英伟达CUDA宣布20年来最重大更新,引入CUDA Tile技术,降低开发门槛。芯片界传奇人物Jim Keller质疑此次更新是否终结CUDA「护城河」,文章分析了相关问题,指出瓦片架构对英伟达内外移植性的不同影响。
揭秘存储超级周期下的机遇与挑战
随着AI算力需求爆发与存储行业超级周期开启,存储芯片价格飙升,引发全产业链连锁反应。这源于AI需求引发的结构性供需失衡,涨价将持续至2026年,还推动半导体产业结构升级。