「性能工程」共找到 2586 篇相关文章
MCP•RL 开源:让 AI 通过强化学习,自己学会怎么用 MCP 服务器
MCP•RL 是 Agent Reinforcement Trainer (ART) 框架一部分,能让 AI 模型通过强化学习学会高效使用 MCP 服务器,解决工具调用痛点。ART 无需标注数据、通用性强,提供便捷集成方式,项目开源。
重磅!中国团队发布SRDA新计算架构,从根源解决AI算力成本问题,DeepSeek“神预言”成真?
国内玉盘AI团队发布《SRDA AI大模型专用计算架构》白皮书,提出全新SRDA计算架构,从硬件源头解决AI算力成本瓶颈。它以数据流为核心,在内存、网络等方面创新,为开发者带来高效、低成本等价值。
超 10 万人都在看!Qwen3重塑文本嵌入与重排序技术版图
文本嵌入和重排序是NLP和信息检索关键组件。Qwen3 Embedding、Qwen3 Rerank模型基于Qwen3基础模型构建,有三种参数尺寸。文章介绍其架构、训练方案,还给出实战代码。
OceanBase全面拥抱AI!首发PowerRAG产品,CTO杨传辉详解AI战略
OceanBase在第三届开发者大会发布面向AI的应用产品PowerRAG,CTO杨传辉解释其AI战略,即构建Data×AI能力,推动一体化数据库向一体化数据底座演进,这对行业发展有推动作用。
谢赛宁等推出统一多模态模型!替代VAE实现图像理解/生成双SOTA,代码权重数据集全开源
谢赛宁等团队推出统一多模态模型Blip3 - o,用扩散Transformer生成CLIP图像特征,采用顺序预训练策略。对比多种设计方案,确定CLIP + Flow Matching最佳,模型在多任务测试表现卓越且全开源。
开源如何促进平台构建过程中的协作
在KubeCon & CloudNativeCon欧洲大会上,Marcy Paramonova和Stéphane Cusin发表演讲指出平台是协作系统,需共同标准。开源提供共享标准与统一语言,还谈到赢得信任、文化转变等方面举措。
DMLR 2026 | RPI Shaowu Pan(潘韶武)团队 Nithin Somasekharan等:CFDLLMBench——首个面向计算流体力学的大语言模型综合基准评测
文章介绍针对CFD领域的综合LLM评测基准CFDLLMBench,构建三层递进挑战体系。实验揭示主流LLM在‘知道’与‘做到’间有差距,多智能体框架可提升成功率,代码与数据集已开源。
林俊旸离职后首次发声!复盘千问的弯路,指出AI的新路
林俊旸离职阿里千问后发声,反思千问技术路线,认为千问合并两种模式未做好。他指出推理时代已过,未来是智能体时代,智能体思考将成主流,还阐述了其与推理思考区别及面临的挑战。
Harness Engineering 的防御视角:从 Codex Security 看 AI 生成代码的治理
作者用 Codex Security 分析项目,发现它不仅列漏洞,还提供攻击路径等。AI 没创造新漏洞,却放大缺陷,需新方式治理大规模自动生成代码,Harness Engineering 有防御价值。
AI编程的下半场来了?学会用Agent Skill解决编程的痛点问题
文章分享用 Agent Skill 解决 AI Coding 痛点的实操复盘,如让代码上线、解决 AI 不用 Skill 问题。介绍 Skills 原理、CloudBase Skills 优势及与 MCP 组合,还给出实战案例、踩坑经验和未来规划。