「架构模式」共找到 2654 篇相关文章
破立之间:智驾芯片博弈的“新赛道”
全球汽车产业向智能化转型,智驾芯片成产业链核心。当前产业面临多重困境,国际巨头垄断高端市场,行业陷入“算力堆砌”。SDSoW技术是破局之道,有三大特征,能实现性能、能效等多方面提升。
中国算力芯片的“新十年”
文章指出过去40年处理器芯片发展呈“否定之否定”,近年整机和平台厂商重归自研,异构计算成趋势。未来中国算力芯片突破口在指令系统结构统一,可把RISC - V作统一指令系统开发各类芯片。
创新中心 | 2025首届“幻镜”AI视听测评季成果在京发布,探索AI视听领域建立科学测评体系
2025年10月28日,“人工智能赋能精品创作沙龙”暨首届“幻镜”AI视听测评季成果发布会在京举办,活动旨在为AI视听领域建科学测评体系。会上公布测评结果、优秀作品片单,发布研究分析报告。
Talos Linux:为 Kubernetes 操作带来不可变性和安全性
Sidero Labs开发了专为运行Kubernetes的不可变操作系统Talos Linux及集群生命周期管理平台Omni。InfoQ采访Sidero团队,探讨其以极简和安全优先理念简化Kubernetes操作,还谈及产品战略、应用场景等。
红色警报:OpenAI的Atlas浏览器,是捅向谷歌万亿心脏的匕首吗?
OpenAI推出ChatGPT Atlas浏览器,争夺全球互联网入口,直指谷歌核心业务命脉。谷歌核心收入源于搜索广告,Chrome是确保流量的关键。而Atlas以‘回答’和‘执行’为核心,或让谷歌广告竞价系统失效,谷歌必将强力反击。
vLLM PIECEWISE CUDA Graph 技术学习笔记
文章围绕vLLM PIECEWISE CUDA Graph技术展开,介绍了vLLM Compilation架构、分片编译技术、算子融合、集合通信融合、编译缓存、装饰器系统等内容,PIECEWISE技术让vLLM在prefill阶段性能提升。
故障率降低100倍,微软突破性技术破解AI算力浪费大难题
在AI数据中心,网络链路高故障率制约算力释放。微软在“ACM SIGCOMM 2025”大会公布MOSAIC技术,将链路故障率降100倍,实现50米长距传输、最高68%功耗降低,为大规模AI集群提供支撑。
OpenAI和Anthropic罕见互评模型:Claude幻觉明显要低
OpenAI和Anthropic罕见合作,互相授予API权限评估模型安全与对齐情况并发布报告。双方派出多模型参与,从指令层次、越狱、幻觉、欺骗策略等方面评测,呈现各模型优缺点。
告别「面瘫」配音,InfiniteTalk开启从口型同步到全身表达新范式
传统video dubbing技术有局限,新兴模型也有问题。美团视觉智能部研发的InfiniteTalk引入‘稀疏帧video dubbing’,实现口型、表情、肢体与音频自然对齐,解决长视频生成难题,技术已开源。
马斯克掀桌子了,最强开源大模型诞生!Grok-2近万亿参数性能首曝
xAI官宣向所有人开源Grok - 2,其有9050亿参数、128k上下文窗口等强大技术规格。还梳理了开源部分、技术特点、权限等,介绍使用方法,网友和大佬高度评价,马斯克预告后续计划。