「文章转述」共找到 1483 篇相关文章
本地LLM万字救场指南来了!全网超全AI实测:4卡狂飙70B大模型
文章围绕本地大语言模型(LLM)展开,针对实用性和经济性问题,用Dell Precision 7960塔式工作站对主流模型测试。涉及不同尺寸模型、推理框架等,给出不同配置下性能指标及使用建议,还模拟真实场景测试。
如何让 AI 成为你的编程搭档?一次真实重构告诉你答案
文章介绍编程工具Cursor,它是基于VS Code、深度集成AI的智能代码编辑器,有多种模式,能力强但有局限。作者分享用其完成重构需求的过程、经验,还提及使用中踩坑及应对方案,最后总结提效成果。
kimi 的RL end2end ON LLM
文章分享Kimi Researcher背后技术思考,采用端到端强化学习打造大模型Agent。对比传统方法,凸显其灵活通用、能力上限高、可扩展优势。还展示其在考试榜单成绩提升及智能“涌现”,介绍多应用场景。
如何像 Manus 交付业务需求-- OneAgent + MCPs 范式
文章介绍 Agent 发展历程,从单一 LLM 调用到 OneAgent + MCPs 范式。Manus 是 Loop 框架典型代表,将其与 Cline 开发范式结合企业 MCP Server,可完成多业务需求。同时指出该范式不足及发展方向,还介绍强化学习应用。
[Triton编程][基础]vLLM Triton Merge Attention States Kernel详解
文章详细介绍vLLM中Triton Merge Attention States Kernel的实现,与PyTorch原生实现对比,该Triton kernel最高可实现3 - 5倍以上算子加速。内容涵盖Merge Attention States概念、PyTorch实现、Triton基础算子、分析及性能评估等。
一个国产AI视频产品如何吸引全球6000万用户?|甲子光年
文章围绕爱诗科技旗下AI视频产品PixVerse展开,讲述其吸引全球6000万用户的历程。介绍创始人王长虎两次技术路线转型,先做To C再推API,还谈及B端业务场景及‘拍我AI’国内上线等情况。
Tool-Star:赋予大模型结合多工具推理的能力
文章提出Tool - Star框架,旨在解决大模型多工具协作推理难题。它从数据端到训练流程优化,让模型调用多种工具,在复杂计算和知识型推理任务表现卓越,还探讨了未来多模态及多工具扩展方向。
Spring AI 实战|Spring AI入门之DeepSeek调用
文章介绍Spring AI框架,它简化企业数据或API服务与大模型集成,降低开发复杂度。还给出调用DeepSeek的实战步骤,包括手动请求、代码自动发起、实现流式响应等,也提及OpenAI starter的兼容性及生产环境监控。
你还在关注大模型排名?这家公司已在全球收割AI红利,做“真正能交付结果的”Super Agents
文章借昆仑万维财报,探讨AI商业化进程。该公司战略重视AIGC,有全面业务场景。其发布的天工超级智能体解决行业痛点,上线APP拓展办公场景。财报显示营收增长,AI业务成引擎,为行业提供借鉴。
Multi-Agent 的灵活编排之路
文章从Copilot 3.0架构规划模块出发,结合DeepSeek R1强化学习训练实践,探讨多智能体架构下大模型编排智能体解决问题。分析Copilot 2.0局限并介绍3.0升级,指出难点,展示效果对比及解决方案。