「架构问题」共找到 4642 篇相关文章
当 Agent 开始接管工作流,企业最在意的三件事:安全运行、稳定交付、持续进化
Agentic AI 开发落地使基础设施问题凸显。AI 产业转向重视模型部署等,CPU 受关注,云计算角色转变,容器重要性凸显。Agent 应用规模化落地,AI 负载变化,Agent Infra 要解决四个问题,云和 CPU 任务也在改变。
你花80%精力调的AI,效果被 PDF 解析卡死了
做RAG时,花80%精力优化embedding和检索,效果上限却被PDF解析卡死。OpenDataLoader PDF靠不同架构在基准测试获第一,采用混合架构,还做了三件其他解析器不做的事,思路值得学习。
英伟达放弃GPU上LPU:新推理芯片被曝Groq即买即用,OpenAI第一个吃螃蟹
英伟达将在GTC大会发布新AI推理系统,核心芯片基于Groq的LPU架构,首位大客户是OpenAI。选择外部架构与时间窗口有关,推理场景中LPU更适配。同时,英伟达推理芯片面临诸多威胁。
用Codex做跨境电商:第四章
文章为《用Codex做跨境电商》第四章,聚焦选品工作流,以Pilates环为例,要核对三个问题有无市场与供应链证据,决定后续行动。交付物为选品卡,强调区分参考Listing、候选产品设想和样品。
Relink:为GraphRAG动态构建证据图
大语言模型在开放域问答中有‘幻觉’问题,GraphRAG结合LLM与知识图谱缓解此问题,但现有方法有缺陷。作者提出‘推理并构建’新范式和Relink框架,实验显示其性能领先,对RAG系统设计有启示。
变更即指标:用交付信号度量系统可靠性
系统变更是生产事故主因,本文提出聚焦变更可观测性的指标框架,介绍可扩展架构采集展示指标。定义业务和技术指标,构建以事件为中心架构获取数据,还阐述以数据驱动改进变更交付过程。
Anthropic 哲学家首次 AMA:关于 AI 哲学与伦理边界
Anthropic的哲学家Amanda Askell在首次AMA中,就AI哲学与伦理边界等诸多问题作答,涉及AI道德决策、模型特点、理论与实践、模型福祉等内容,还谈及对各类问题的看法及解决思路。
揭示隐藏联系:RLHF/DPO即对比学习!
大型语言模型输出符合人类价值观是挑战,主流技术RLHF复杂、昂贵且不稳定,DPO简化流程但有训练崩溃问题。论文揭示RLHF/DPO即对比学习,提出MIO算法解决DPO崩溃,实验验证其性能优势。
AI PPT,这次是真不用返工了
过去AI做PPT虽快但有“幻觉数据”和“拼凑式模板”问题,被认为是高估需求。如今讯飞智文Vision Agent出现,能生成专业PPT,还解决了美观、内容等问题,将AI PPT带入2.0阶段。
瞄准AI、图形顶端战场:摩尔线程上演国产GPU硬核实力路演
摩尔线程首届 MUSA 开发者大会集中亮相技术体系。发布新一代统一计算架构 MUSA 路线图,介绍新架构、芯片及万卡集群,还涉及前沿布局,发起开发者培训,推出 AI 算力笔记本,宣告国产算力自主化时代加速到来。