「Token 效率」共找到 1763 篇相关文章
豆包 1.6发布后,我用火山引擎Trae + MCP,仅半天做了一个“秒懂科研”的PaperAgent!
文章介绍用火山引擎Trae + MCP和豆包1.6构建“秒懂科研”的PaperAgent。对比其与传统开发范式,突出前者高效、低成本优势,还展示了PaperAgent技术栈及开发过程,体现AI云原生开发魅力。
从辅助工具到智能决策,大模型如何改变人才选拔方式?
随着大模型应用拓展,企业人力资源管理成落地热点。阿里巴巴技术专家程鹏认为,大模型在人才选拔与培养中有效率、个性化、客观决策等颠覆性价值,也面临落地挑战,还分享应对策略等内容。
微信自研高性能推理计算引擎 XNet-DNN:跨平台 GPU 部署大语言模型及优化实践
本文深入解析微信自研的高性能推理计算引擎 XNet-DNN,介绍其核心技术架构和性能优化策略。该引擎基于 RCI 框架构建跨平台 GPU LLM 推理能力,在多方面超越现有解决方案,还给出了详实对比实验数据。
BLIP3-o统一图像生成与理解,多模态融合趋势显现
BLIP3 - o致力于统一图像理解和生成、提升生成质量和效率。它融合自回归与扩散模型,采用CLIP + Flow Matching架构等技术亮点。经训练,在图像理解和生成任务表现出色,指令微调效果显著。
全新GPU高速互联设计,为大模型训练降本增效!北大/阶跃/曦智提出新一代高带宽域架构
随着大模型参数规模扩大,分布式训练成关键路径,高带宽域设计对提升训练效率至关重要。现有HBD架构在可扩展性、成本和容错能力等方面有局限,北大、阶跃、曦智团队提出InfiniteHBD架构解决问题。
这场巅峰对话,把China AI的基因、堵点和未来聊透了|甲子光年
2025年4月28日,甲子光年大会巅峰对话探讨‘China AI如何重塑全球AI价值坐标系’。大模型、算力、具身智能、芯片领域嘉宾各抒己见,谈China AI基因、应对策略、行业堵点及未来判断。
王炸!微软AI Agent支持A2A、MCP协议,智能体黄金时代降临
今天凌晨微软官网宣布Azure AI Foundry和Microsoft Copilot Studio支持Agent开发协议A2A,还会与谷歌合作扩大该协议。此前微软已支持MCP,两协议能打破智能体诸多壁垒,提升开发、自动化效率。
惊天大瓜!中东土豪发「纯血」大模型,背后底座竟是MiniMax?
沙特发布号称100%沙特血统的国家级大模型HUMAIN M3,后被发现基于中国MiniMax的M3模型。沙特用超1万亿阿拉伯语Tokens后训练,使模型在阿拉伯语赛道领先,代表中国AI出海新形态。
刚刚,OpenAI新Transformer火了!Astra架构首次曝光
OpenAI下一代Astra采用「循环深度」推理方法,思考Token减少但性能提升,不过其思考过程难监控。此前业界已对「循环Transformer」有研究,该架构适合数学编程任务,Astra实力获验证,GPT - 6或即将发布。
别指望你的组织能变得 AI Native
一家公司买企业级 AI 授权全员铺开,虽 88% 员工采用,但交付速度未变,仅 10% 的人烧掉 90% 的 Token。文章指出企业 AI 采用率指标荒诞,分析企业 AI 应用现状,还给出落地推进建议。