「系统架构能力」共找到 5746 篇相关文章
小米小爱同学:资源受限下,实现端侧大模型的高性能推理
InfoQ对话小米小爱同学端侧AI负责人杨永杰,探讨大模型端侧部署难题。团队自研推理框架,实现180 tokens/s推理速度,采用共享基座架构支持多业务。未来端侧大模型突破依赖硬件提升与架构演进。
OpenAI没做到,DeepSeek搞定了!开源引爆推理革命
文章围绕大语言模型推理能力展开,介绍了推理模型概念,回顾RLHF训练流程,对比OpenAI的PPO和DeepSeek的GRPO,还阐述了GRPO开源升级版DAPO的关键技术点及训练中模型的新能力。
刚刚,GPT-5.4 发布,百万上下文、最强全能模型
OpenAI发布GPT - 5.4,集推理、编程等能力于一体,支持百万级上下文窗口。有三个版本,功能全面升级,如支持中途打断、电脑操作、视觉能力提升等,还更省token、少幻觉,安全机制完善,价格有调整。
专为宅男打造系统提示词,“二次元女友”爆火后马斯克开 44 万刀抢工程师
xAI 在 Grok iOS 应用推出 AI“虚拟伴侣”角色后,发布“全栈工程师 – Waifus”招聘,年薪高达 44 万美元。岗位负责打造实时虚拟形象系统,引发热议。不过,Grok 部分内容引 App Store 内容边界担忧。
每周产业洞察 | AI音视频模型能力全面嵌入“专业级视听内容”交付,对齐“制作级”
北京AIGC视听产业创新中心位于朝阳区,是朝阳区推动影视制作基地建设举措。由多方参与,首创郎园运营,提供六大服务平台,截至2025年8月汇聚近百家合作伙伴。首创郎园拓展服务能力,项目多地开花。
Meta&UIUC大发现:无需标注,Agent复杂的工具使用和搜索能力,是可以“无中生有”的
Meta和UIUC研究发现,无需标注,Agent复杂工具使用和搜索能力可“无中生有”。论文Dr. Zero让大模型自我博弈成搜索专家,用HRPO提效,设计难度导向奖励,实验表现佳,但也存在局限。
看完快手这场沙龙,我对生成式推荐的判断变了
作者参加快手技术沙龙,认为生成式推荐正重构推荐系统底座。快手在生成式推荐领域体系化演进,如OneReason让推荐系统学会思考,Pool - Rec解决算力问题,OneSearch V2和GR4AD用于场景实践,还举办LLM - Rec挑战赛。
MIRIX重塑AI多模态长期记忆:超Gemini 410%,节省99.9%内存,APP同步上线
UCSD和NYU团队推出开源的MIRIX,全球首个多模态、多智能体AI记忆系统。它表现亮眼,在多任务中超越传统方法,有类人记忆系统等特点,还上线Mac端应用,开启大模型从对话生成到长期记忆驱动心智的新周期。
揭秘大模型Steering:从底层机理到系统评估,全面破解大模型行为控制之谜
近期《Science》研究表明可解析AI内部表征实现通用引导与监控。浙大联合阿里两篇ACL 2026主会论文,揭示Steering工作原理与能力边界,还开源一站式框架EasyEdit2,全面展示了Steering价值。
刚刚开源就斩获 46K+ Star!生化危机女主在 GitHub 开源了一个本地 AI 记忆系统!
好莱坞女星 Milla Jovovich 针对 AI 记忆痛点,用 Claude Code 开发本地 AI 记忆系统 MemPalace。它存储全部对话,检索快,召回率高、数据安全、扩展性强,适用多类人群。