「大算力芯片」共找到 5945 篇相关文章
社区供稿丨以小博大!Nanbeige4-3B重磅开源:硬刚Qwen3,挑战小模型能力新高度
近年来大语言模型发展陷入‘参数军备竞赛’,成本高昂。Boss直聘南北阁实验室发布Nanbeige4 - 3B,仅30亿参数,在预训练和后训练阶段采用多种创新技术,在多方面媲美甚至超越大模型。
五倍推理加速,激发自回归潜能,苹果新工作让LLM预测未来
近年来自回归训练方法成语言模型主流范式,但推理阶段计算开销大。苹果研究人员开发框架,让预训练自回归大模型多 token 预测,代码和数学任务推理加速达 5.35 倍,一般任务约 2.5 倍。
独家丨商汤科技将成立独立的具身智能公司
AI科技评论独家消息,商汤科技将成立独立具身智能公司,核心班底有王晓刚、陶大程等大咖,正在招人。此前商汤已布局该领域,今年4月展示成果、达成合作,WAIC将发布大模型及平台。
让 AI 自己打怪升级,Meta用Self-play RL把Coding推向超级智能
Meta FAIR、Meta TBD Lab等朝着“超级智能软件工程Agent”迈出第一步。SSR让大模型零人类标注,靠自生成Bug和自修复稳定碾压人类数据基线,新旧范式对比优势明显,还介绍方法、实验结果与理论洞察。
腾讯云与 Gartner 联合发布“Data+AI”白皮书,各行业领军企业分享最佳实践
6月27日,腾讯云联合Gartner发布《Data+AI,下一代数智平台建设指南》白皮书。指出GenAI时代数据变化大,腾讯云打造原生一体化Data+AI平台DIaaS,多位技术大咖分享其赋能企业数智化转型实践。
苏妈联手OpenAI,AMD发布3nm怪兽MI355X,性能碾压英伟达B200!
AI芯片战争白热化,AMD在大会发布3nm工艺的MI355X,推理性能超英伟达B200,还公布明年推出的MI400系列等新品。OpenAI CEO称将用AMD芯片,AMD与OpenAI开启合作。
AI Agent的未来之争:任务规划,该由人主导还是AI自主?——阿里云RDS AI助手的最佳实践
文章以阿里云RDS AI助手实践为例,探讨AI Agent任务规划该由人主导还是AI自主。实测发现大模型自主规划效果不佳,企业更需稳定可靠,人工规划是最佳选择,还提出用‘混合规划’兼顾灵活与可靠。
提示词注入攻击的检测和数据集介绍
提示词注入攻击是攻击者操纵AI系统的技术,OWASP将其列为2025年大模型应用风险首位。Meta发布测试数据集,还有多个工具和数据集可用于评估。防护可用AI防火墙,Meta开源小模型。还提到安全性与实用性权衡。
Vibe Coding成AI主战场:22个明星玩家值得关注
AI产品下半场,氛围编程成赛道焦点。国外大厂推新,国内大厂双轮发力。量子位2025Q3 AI 100榜单显示,开发层产品多增强Agent功能,介绍了旗舰100和创新100中的明星产品。
刚刚,梁文锋被曝史上首次融资!DeepSeek V4彻底摆脱英伟达
外媒曝出DeepSeek正寻求首次外部融资,以不低于100亿美元估值筹集至少3亿美元。V4规模和野心远超前代,参数量达万亿,将运行在华为昇腾芯片上,若成功将脱离英伟达生态。