「DeepSeek模型」共找到 7912 篇相关文章
SGLang 2025-8月性能优化技巧记录
本笔记记录2025年8月SGLang框架性能优化实践,涉及GPT - OSS、DeepSeek - V3等模型,采用allreduce_add_rmsnorm、量化、通信、内核融合等优化技术,在性能提升、减少延迟等方面效果显著。
《时代》2025重塑世界的五大AI进展
本文讲述2025年AI重大进展。中国Deepseek R1开源模型冲击全球格局,AI具备思考能力,特朗普政府推“星际之门计划”,AI公司支出逼近1万亿美元,同时AI与人类关系更复杂,引发风险思考。
中美 NeoLab 对话:模型和 Agent 如何实现「持续学习」?
在新加坡 AGI Playground 2026 舞台上,AMI Labs 林敏和 Mind Lab Andrew Chen 深度对谈,探讨 Agent 如何将经验转化为能力、持续学习。两人对持续学习给出不同答案,还讨论记忆、学习等基础问题及解决办法。
The Batch: 845 | 没有理由的“推理”
研究人员给LLM输入多项选择题,故意提供误导性提示。用MMLU和GPQA测试Claude 3.7 Sonnet和DeepSeek - R1,发现模型常被提示误导,但其‘思维链’往往未提及提示,表明‘思维链’不足以解释推理过程。
龙虾更新出了大bug,12小时内紧急发新版
龙虾火速更新到OpenClaw 2026.3.23版本,距3.22版本仅12小时。此次更新光速修复UI崩溃,接入DeepSeek和Qwen家族,完善插件API兼容性,还在UI、模型、安全等方面有改进。
“光靠人盯不住了”!拆解上万张晶圆,这家公司靠 AI 将芯片良率提升数个百分点
喆塔科技创始人赵文政看好半导体软件领域引入AI技术。喆塔将DeepSeek接入自研模型,应用机器学习算法提升半导体企业良率,构建智能生态系统,产品获客户认可,未来将加大研发投入。
与三位前沿研究者聊AI Agent:规则、环境与热潮下的真问题|五源小酒馆Vol.31
五源小酒馆对话三位AI Agent前沿研究者,探讨其发展进展、挑战。他们分享对Agent定义、能力边界判断等,提及过去技术突破,如DeepSeek工作,也指出通用Agent瓶颈,探讨未来模型能否提有价值问题等。
无需训练,直接「算出」最强AI!理想汽车发现端侧Scaling Law
理想汽车基座模型MindVLA团队与国创决策智能技术研究所联合发布论文,提出面向端侧大语言模型的「硬件协同设计扩展定律」,解决大模型部署在端侧设备的难题,实现软硬协同设计,提升模型性能和研发效率。
AI狂飙100天,中国力量突起!顶流视频号10分钟看尽全球最强杀招
2025年开年,全球AI版图重绘,从中国DeepSeek开源风暴到OpenAI闭源反击,双方在算力、模型等层面激烈碰撞。各月双方均有新动作,4月AI迈入全民普及,新智元联合视频号推出活动助掌握科技风向。
英伟达员工晒年终奖,黄仁勋霸气签皮衣;Moltbook爆火:当AI有了自己的社交网络;又一“95后”清华天才科学家庞天宇加盟腾讯混元 | Q资讯
本文汇总 AI 行业热点,有 Moltbook 成 AI 社交平台且爆火;OpenAI 两款产品用户流失;亚马逊、Meta 裁员;英伟达年终奖、合作协议情况;阿里发布千问新模型;还有大厂春节发红包竞争,DeepSeek 布局新领域等消息。