「可预测并行架构」共找到 2405 篇相关文章
The Batch:826 | 提高输出准确性的记忆层
通常提高大语言模型事实准确性需更大模型规模,会增加计算成本。Meta研究人员在transformer架构加可训练记忆层,可高效存储提取信息,提升计算效率,测试显示其能提升模型输出质量。
北大校友、OpenAI前安全副总裁Lilian Weng关于模型的新思考:Why We Think
北大校友Lilian Weng更新博客《Why We Think》,回顾利用测试时计算研究进展,探讨激励模型思考方式,介绍思维链、并行采样、序列修订等策略,还提及强化学习、外部工具使用及未来研究方向。
图像分词器造反了!华为 Selftok:自回归内核完美统一扩散模型,触发像素自主推理
华为盘古多模态生成团队推出 Selftok 技术,通过反向扩散将自回归先验融入视觉 token。它突破传统,实现因果 token、强化学习友好型 token 及纯 AR 大一统架构,实验在多方面表现优异,论文还入选 CVPR 2025 最佳候选。
用DAA衡量智能体 百度智能云用“新全栈”重新定义AI云|甲子光年
2026年产业焦点转向智能体落地,李彦宏提出DAA概念。百度智能云升级为新全栈AI云,解决智能体落地难题,从架构决策、行业应用等多方面发力,其价值值得市场重估。
米哈游蔡浩宇AI公司首个视频模型曝光了
米哈游蔡浩宇的AI公司Anuttacon首个视频模型LPM 1.0曝光。它可通过多模态形式生成动态角色,有超绝情绪演绎、实时视频生成等能力,背后技术架构复杂,目前未正式上线。
全球首个AI原生社交平台「Teamily AI」硅谷亮相,开启「人机共生」社交新元年
2026 年伊始,业界探索 AI 与人类真实交互。初创公司 Teamily AI 推出全球首个 AI 原生即时通讯应用,构建人类与 AI 共生社交网络,主打四大场景全域伴随,有三层架构技术护城河。
GPU为什么能取代CPU,成为计算领域无可争议的核心?
过去CPU是计算核心,如今GPU凭借并行处理能力崛起。在人工智能、大数据等领域,GPU优势明显,软件支持也推动其普及。未来,GPU将在更多领域发挥作用,还会与CPU融合。
硅谷CEO们高喊AI威胁论,「5年内失业率飙升至20%」,但95%AI项目赔本赚吆喝
当下‘AI 威胁就业’论调甚嚣尘上,如Anthropic等公司高管预测失业率飙升。耶鲁大学论文分析AGI经济中人类劳动地位。但MIT报告显示,95%公司AI项目未获商业回报,多数试点停滞。
英伟达斥资50亿美元入股英特尔
18日,英伟达与英特尔宣布深度合作,联合开发产品。英伟达将斥资50亿美元入股英特尔,双方以NVLink技术连接架构,合作聚焦数据中心和个人计算领域,旨在提升运行效率,填补产品空白。
AI行业的底牌已经亮完了,模型能力趋同后,拼什么?
Databricks MVP Adi Polak分析AI人才需求,指出能搭建评估管道等的工程师是硬通货。前沿模型架构趋同,行业从技术竞赛转向生态战争,比拼产品和用户理解能力,还为转型工程师给出建议。