「开源实现」共找到 4732 篇相关文章
西工大张伟伟团队:大模型时代航空科技的蓝图畅想 | 航空学报CJA
随着国产开源大模型涌现,大语言模型走入生活,挑战传统航空教育,革新科研范式,与航空产业融合推动变革。西工大张伟伟团队探讨其在航空工程教育、科研、行业全链条的影响及挑战。
干货的一天 -【MCP协议驱动的AI新范式】峰会活动精彩回顾
2025年6月14日,“MCP协议驱动的AI新范式”峰会在上海举办。活动汇聚多企业专家与社区代表,通过主题演讲和工作坊,深度探讨MCP协议在技术、商业及生态建设中的价值,多位专家分享见解与技术成果。
揭秘千卡 GPU 集群如何高效训练多模态大模型:vivo AI 团队实战经验分享|AICon
在 InfoQ 举办的 AICon 大会上,vivo AI 架构师王兆雄分享多模态大模型训练经验。介绍了 LLaVA 和 DiT 模型训练挑战,从数据处理、模型计算等方面提出优化策略,还展望 AI Infra 未来发展方向。
MIT工科生跨界AI,独作论文登Nature:只需3.5小时修复600年前名画
MIT理工男Alex Kachkine跨界艺术,独作论文登Nature。他设计的AI算法将名画修复时间从数月/数年压缩至几小时,提出“以数字方式修复一幅画,并在物理上实现效果”的新方法。
高通将以24亿美元收购Alphawave Semi,增强AI数据中心份额
高通官网宣布以24亿美元收购Alphawave Semi全部已发行及待发行普通股票,旨在加速其数据中心领域扩张。Alphawave技术能实现高速数据传输,与高通处理器互补,双方将携手推动AI计算等领域发展。
SGLang 推理引擎的技术要点与部署实践|AICon 北京站前瞻
SGLang 是开源推理引擎,截至 2025 年 6 月,GitHub 近 15K Stars,月均下载量超 10 万次,被多个行业巨头采纳。InfoQ 专访其核心开发者尹良升,他分享关键技术等内容,6 月 27 - 28 日他将在 AICon 演讲。
The Batch:829 | DeepSeek 是怎么做到的
DeepSeek 去年末以低成本训练出先进开源大模型引关注,近日团队披露构建 DeepSeek - R1 和 DeepSeek - V3 的软硬件方案,降低内存和计算需求,其细节公布让更多团队有机会参与前沿研发。
Agent 工程师绕不开的必修课:API 网关 vs API 管理
文章探讨了 API 网关与 API 管理的起源发展、关键差异、协同工作及未来趋势。API 网关从流量网关演进到 AI 网关,API 管理从文档化走向商业化。两者差异源于起点、使用角色和技术内核不同,未来将向 AI 网关和 MCP Server 管理演进。
LLM省钱大测评!48块GH200,首个百亿级参数量实证
EfficientLLM项目聚焦LLM效率,提出三轴分类法和六大指标,实验覆盖多方面。研究表明效率优化需权衡,最优策略因任务和模型规模而异,且相关技术可迁移到跨模态模型,成果将开源。
港科联合港中文提出AdaCtrl,自适应可控Reasoning,可降10~90%
港科联合港中文提出AdaCtrl,解决LLM推理的过度思考、算力浪费和响应延迟问题。它有自适应和用户控制两种模式,通过两阶段训练法实现目标,实验效果好,未来或拓展到多领域。