「高性能芯片」共找到 3884 篇相关文章
腾讯混元开源 4 个小尺寸模型,主打 Agent 和长文
8月4日,腾讯混元开源四款小尺寸模型,参数为0.5B、1.8B、4B、7B,消费级显卡可运行,适用于低功耗场景。模型具备推理快、性价比高特点,亮点是Agent和长文能力,已在腾讯多业务应用。
细节直逼亚毫米级!港科广分层建模突破3D人体生成|CVPR 2025
港科广团队提出MultiGO创新方案,借助分层建模思路突破3D人体生成难题。该方案通过三级几何学习框架提升重建质量,在多个测试集上性能领先,且在多领域有应用优势,研究成果入选CVPR 2025,项目代码将开源。
谷歌卷土重来:你大爷还是你大爷
上周谷歌横扫科技媒体头条,英伟达官方X账号点赞谷歌TPU成绩后话锋一转称自家产品领先。此前有传闻Meta考虑换用谷歌TPU,消息致英伟达市值蒸发、谷歌市值上涨。今年谷歌发布Gemini - 3系列模型,其自研芯片TPU引发关注。
当AI从云端“下沉”,Arm如何赋能端侧
端侧AI发展近十年,已进入应用快速拓展期,成为推动消费电子革新重要力量,但面临视觉处理、内存平衡和应用迭代等挑战。Arm推出相关平台与技术,如SME2,提升AI性能与能效,还与厂商合作,持续创新赋能端侧。
英伟达最新财报出炉,业绩展望引担忧
8月28日,英伟达公布2026财年第二财季业绩和第三财季指引。二财季业绩略超预期但毛利率下滑,数据中心业务增速放缓。平淡展望引发股市震荡,还引发投资者对AI支出担忧。其未向中国售H20芯片,中国市场缺失或影响业绩。
LLM+RL遭严重质疑,随机/错误等虚假奖励也能提升至标准效果?
论文在AI领域观察到类似随机给糖或奖励错误答案让孩子成绩提升的现象,‘虚假奖励四大奇招’效果接近用标准答案训练,Qwen2.5 - Math - 7B模型在测试集上性能飙升,还揭示了Qwen特别的原因及随机奖励有效的推手。
多快好省,Qwen3混合部署模式引爆MCP
文章介绍Qwen3混合部署模式在MCP中的应用。MCP是AI与外部交互的标准协议,解决传统问题。Qwen3性能强、成本低,有混合思维等特点。通过本地小尺寸和满血版结合部署,实现多快好省,但仍有资源消耗等不足。
机器人整机是“有限游戏”?对话星海图创始人:具身智能商业化的三个阶段,终点是卖Token
星海图CEO高继扬等提出具身智能三重跃迁,发布新模型并开源,首秀自研机器人。公司从整机起步,联合建数据公司,规划数据量。其商业模式分三阶段,认为中国具身基础模型能力有望超美。
Life of a Token:像调试代码一样看懂大模型如何生成 Token
文章类比 Chrome 的 Life of a Pixel,追踪 LLM 里 token 从输入到输出的全程。以 GPT - 2 Small 为例,详细讲解其管线各阶段,如 Tokenization、Embedding 等,还介绍了残差流、KV Cache 等概念及 GPU 性能瓶颈和优化方法。
12月首炸!可灵 O1 正式发布,全球首个统一多模态视频大模型,强得可怕!
12月快手旗下可灵发布全球首个统一多模态视频大模型Kling O1,标志AI视频进入“全流程语义控制时代”。它将多种视频创作能力统一,有全能引擎等五大亮点,性能对比优势明显,让AI视频生成更可控。