「好表现定义」共找到 3238 篇相关文章
腾讯混元AI Infra核心技术重磅开源:推理吞吐提升30%!
腾讯混元AI Infra团队开源生产级高性能LLM推理核心算子库HPC-Ops,基于生产环境痛点开发,降低底层算子开发门槛,实现显著性能突破。在真实场景下,混元、DeepSeek模型推理QPM提升,单算子性能也超越主流算子库。
刚刚,DeepSeek又探索新架构了,开源OCR 2
DeepSeek更新DeepSeek - OCR 2,引入DeepEncoder V2架构,实现视觉编码范式转变。模型和技术报告齐开源,在多项测试中表现出色,降低重复率,为全模态编码提供路径,但在报纸类文档识别有不足。
马化腾内部员工大会安利「元宝派」新玩法,结合腾讯优势开启AI社交新赛道
腾讯2026年员工大会上,马化腾强调保持定力。过去一年混元大模型深度重构,吸引人才。AI助手元宝发展佳,即将推出“元宝派”新玩法,还针对春节推10亿现金红包活动,马化腾现场安利。
真·开外挂!MIT新研究:架构0改动,让大模型解锁千万级上下文
MIT CSAIL团队提出递归语言模型RLM,不改动模型架构,让GPT - 5、Qwen - 3等模型具备千万级token超长文本处理能力。它将上下文处理“外包”,实验显示其处理规模超前沿模型,复杂任务优势显著,多数场景性价比高。
专为小说、角色扮演等而生:元象开源泛娱乐场景底座模型
元象作为AI与3D技术服务公司,此次开源XVERSE-Ent系列中英双语大模型。它采用MoE热启动技术与三阶段训练策略,解决泛娱乐场景痛点,适配多元语境,有高部署性价比,为行业提供泛娱乐AI解决方案。
Manus 产品立项初期会议纪要
该文是 Manus 产品立项初期会议纪要,从核心定位到技术架构、用户体验、人机协作等多方面深入探讨,为项目明确战略、技术、产品层面核心原则,开启重新定义智能体之旅。
全球功能最全的视频生成模型来了
阿里发布新一代通义万相2.6系列模型,是全球功能最全的视频生成模型,覆盖文生视频等多种模式。它在视频创作和文生图方面能力提升,虽有小瑕疵,但日常短视频和二创已可用。
英伟达开源全新大模型:黄仁勋不想只「卖铲子」
2025年底英伟达宣布开源全新模型家族Nemotron 3,含Nano、Super和Ultra。它融合Mamba、Transformer和MoE技术,有诸多创新。这不仅是产品更新,更是战略突袭,标志着英伟达想构建AI闭环开放生态。
社区供稿丨以小博大!Nanbeige4-3B重磅开源:硬刚Qwen3,挑战小模型能力新高度
近年来大语言模型发展陷入‘参数军备竞赛’,成本高昂。Boss直聘南北阁实验室发布Nanbeige4 - 3B,仅30亿参数,在预训练和后训练阶段采用多种创新技术,在多方面媲美甚至超越大模型。
小扎忍痛,亲口宣告了元宇宙的死亡
扎克伯格的「元宇宙」执念向现实低头,Meta计划削减Reality Labs元宇宙部门人力,将资源倾斜至AI智能眼镜。此前Reality Labs四年亏超700亿美元,而智能眼镜销量火爆。