「吞吐量提升」共找到 2953 篇相关文章
重磅!中国团队发布SRDA新计算架构,从根源解决AI算力成本问题,DeepSeek“神预言”成真?
国内玉盘AI团队发布《SRDA AI大模型专用计算架构》白皮书,提出全新SRDA计算架构,从硬件源头解决AI算力成本瓶颈。它以数据流为核心,在内存、网络等方面创新,为开发者带来高效、低成本等价值。
超 10 万人都在看!Qwen3重塑文本嵌入与重排序技术版图
文本嵌入和重排序是NLP和信息检索关键组件。Qwen3 Embedding、Qwen3 Rerank模型基于Qwen3基础模型构建,有三种参数尺寸。文章介绍其架构、训练方案,还给出实战代码。
腾讯Kuikly框架鸿蒙版正式开源 —— 揭秘卓越性能适配之旅
腾讯将广泛使用的跨端开发框架Kuikly鸿蒙版正式开源,已接入多款业务。它有高性能、动态化特点,适配中解决渲染、文本性能等问题,还优化调试效率,发布Compose DSL Beta版。
MCP技术浪潮中的Agent应用开发新范式
当下,MCP迅速发展重塑AI开发协作生态。太极平台借MCP汇聚多方能力,释放大模型潜能。文章介绍MCP技术、执行细节,探讨其与Agent、Function Calling关系,分析技术生态,还思考了MCP发展变化与局限。
Borg调度进化了!谷歌超强AI Agent 登场:能设计算法、提效系统,陶哲轩亲自助攻,网友封神理科扛把子!
谷歌 DeepMind 推出由 Gemini 驱动的 AI 智能体 AlphaEvolve,能设计算法、提效系统,破多项数学记录。它已用于谷歌多领域,还将探索材料、药物研发等领域,也计划推早期访问计划。
92% 工程师都在用 AI 后,Uber 开始给 AI “限额”了
Uber的‘零增长技术栈’解耦容量与业务需求,优化Go运行时性能。还将生成式AI集成开发,92%工程师在用,但成本压力大。为此,Uber限额每位开发者,审查代码效果,完善评估指标。
优步通过实时信号与 Listwise 排序改进餐厅推荐
优步在Uber Eats推荐系统引入实时用户信号与Listwise排序法,用实时信号处理层替换早期特征流水线,还引入Listwise排序优化候选餐厅排序,降低特征漂移,保障系统性能。
世界模型来了因果技术标杆!具身大脑真要长脑子了
具身智能有泛化能力瓶颈,构建‘世界模型’成热门赛道。Aether AI获2000万美元种子轮融资,走因果世界模型路线,创始人黄碧薇认为这是世界模型‘终局形态’,能让机器人理解物理规律。
让思考更准更长!强化学习新算法FIPO来了
阿里通义实验室Qwen Pilot团队发布系列博客剖析大模型强化学习机制与局限,推出新算法FIPO。该算法引入Future - KL机制,解决‘推理长度停滞’问题,在多项测试表现优异,还介绍招聘信息。
14.5K!冲上Github Trending榜,字节最新开源Agent上下文"数据库"!
OpenViking是字节跳动火山引擎开源的AI Agent上下文数据库。它用文件系统范式管理上下文,有分层加载、递归检索、可视化轨迹和自动会话管理等特性,支持多种模型,测试效果显著。