「高带宽域架构」共找到 3509 篇相关文章
腾讯AI战略大升级:组织架构重组与混元世界模型1.5发布
2025年12月17日,腾讯宣布两项重大举措,一是重组AI组织架构,成立新部门并任命首席AI科学家;二是发布混元世界模型1.5,能实时生成可交互3D虚拟世界,应用场景广泛,或引领行业进入‘AI原生’新阶段。
Gemini 2.5 Pro 再升级!竞技场分数创新高+思考预算,更强 Kingfall 在路上?
谷歌更新Gemini 2.5 Pro模型预览版,几周后成正式稳定版用于企业级应用。它在多个竞技场分数创新高,编码能力强,还新增“思考预算”功能控成本,价格有竞争力,谷歌还将推更强“Kingfall”。
ICML 2025 | 打破残差连接瓶颈,彩云科技&北邮提出MUDDFormer架构让Transformer再进化!
彩云科技与北邮联合提出多路动态稠密连接(MUDD)替代残差连接,提升Transformer跨层信息传递效率。实验显示,采用该架构的模型性能显著提升,论文等均已公开。
全球高被引第一人,图灵得主Bengio近百万屠榜!Hinton、何恺明冲进TOP 5
全球高被引科学家名单出炉,图灵奖得主Bengio成全球首位「全领域被引最高」学者,Google Scholar主页总引用量97万+。此外,Hinton、何恺明、Ilya Sutskever等计算机领域科学家也冲进总榜TOP 10。
MultiAgent架构实践:如何打造GitHub Stars 2.8k的ComfyUI-Copilot V2.0
ComfyUI是Stable Diffusion生态中可视化编程工具,但使用有难度。ComfyUI - Copilot V2.0基于多智能体协作框架构建,能实现对话开发、报错修复等功能,还介绍了其架构、技术栈及多智能体设计思路等。
视觉思维链全新架构,加州大学让多模态大模型有了灵性,整体性能提升5.3%
加州大学伯克利分校等团队提出视觉思维链(CoVT)架构,让视觉语言模型推理时生成连续视觉信号。它内化轻量级专家能力,采用对齐策略和四阶段训练,实验显示性能提升,还具可解释性。
AI生图大洗牌!流匹配架构颠覆传统,一个模型同时接受文本和图像输入
AI生图有新突破,新模型FLUX.1 Kontext用流匹配架构,与此前技术不同,能接受文本和图像输入。其来自Black Forest Labs,有编辑和生成能力,还具备4个特性,第三方测试也给出提示词使用技巧。
惊现高管离职潮!马斯克亲信操盘xAI,千亿美元能填AGI野望?
马斯克寄予厚望的xAI本月动荡不断,多位核心成员和高管离职,原因包括发展方向分歧和追赶对手的悲观情绪。高层震荡引发公司治理与财务争议,还出现裁员、实习生掌权等乱象,虽招聘但团队士气下滑。
华为盘古首次露出,昇腾原生72B MoE架构,SuperCLUE千亿内模型并列国内第一
当前传统 MoE 有专家激活不均衡问题,华为盘古团队提出 MoGE 解决。基于此架构的盘古 Pro MoE 大模型在昇腾集群高效训练,推理性能强,在 SuperCLUE 榜单千亿内模型并列国内第一,赋能业务落地。
那位曾高喊「AI能接管一切」的CEO后悔了:宣布重启人工招聘!
Klarna CEO曾称AI能取代所有人类工作,公司也实施‘AI优先’战略,用AI客服取代人类、缩减人力。但AI客服实际表现不佳,服务体验差,Klarna决定重启人工招聘,打造‘高质量人类支持’。