「微软策略」共找到 1265 篇相关文章
DevProxy 0.28 发布,增加 AI 支持
微软发布 DevProxy 0.29 命令行工具,新版本增加 AI 支持,便于配置使用。它能模拟 API 及网络行为,结合 dev tunnels CLI 可检查云服务通信,还利用大模型生成文件,有重大架构变更等。
AI Infra进阶:如何让大模型输出确定的结果
文章探讨大模型输出确定性结果的问题。指推理引擎底层动态组批与算子调度策略,因浮点加法顺序变化使结果波动。还分析GEMM、RMSNorm等算子影响,给出vLLM实现Batch Invariance的方法。
LLM的RL训练轨迹竟然是线性的?Miaow Lab|新工作:无需继续训练,直接“预测”未来模型!
文章介绍《Not All Steps are Informative: On the Linearity of LLMs' RLVR Training》,揭示RLVR训练中LLM权重和输出概率线性变化,提出“权重外推”法,可实现6.1倍训练加速,还介绍三种策略及实验结果。
猎头黄仁勋的2025:高管从巨头挖,干活钟爱华人创业团队
2025年英伟达在黄仁勋带领下,通过“黄氏挖人+黄氏收购”重塑“第二增长曲线”。一方面从谷歌、微软等巨头挖高管,补齐关键能力;另一方面收购初创公司吸纳核心团队与技术,多来自华人创业者。
Visual Studio 正式支持 MCP
2025年8月微软宣布模型上下文协议(MCP)在Visual Studio正式可用,为AI智能体与外部工具连接提供一致协议。开发人员可配置文件连接,管理员能管理使用。但存在限制和安全风险。
“扁平+拓扑”双索引,85页PDF"秒级"推理,MMRag幻觉率骤降76%
文章聚焦多模态长文档视觉问答,介绍现有LVLM - based和RAG - based技术路线及困境。提出MMRAG - DocQA方案,引入‘分层索引 + 多粒度检索’,设计双索引建模相关性与依赖,用互补策略实现证据互补。
ParScale:一种全新的大模型Scaling Law
文章提出并行扩展(ParScale)路线,在不增模型参数下,通过引入并行流提升性能。新扩展定律打破传统范式,两阶段后训练策略降成本,还适用于边缘设备,研究仍在进行。
人工智能无法加速软件交付
文章指出速度不是软件交付目标,提升效率是为获反馈。片面追求速度不可取,如微软 Word 因功能堆砌失市场。引入人工智能只为提速不可信,应重视反馈,优化交付流程,借助 AI 打造更有格局产品。
AI下半场的战场,从Agent记忆体正式打响
OpenClaw开源项目爆火,标志AI进入下半场走向真实应用。关键在于解决AI在现实中持续干活的问题,核心是Agent Memory。论文梳理该赛道,指出其是系统级记忆体结构框架,未来关键在memory策略可学习。
用Rust重写OpenClaw,Transformer作者下场造了安全版「龙虾」
Transformer八子之一Illia Polosukhin用Rust构建安全版OpenClaw——IronClaw。他指出OpenClaw有数据和资金安全风险,IronClaw以安全为核心,有多项安全设计,未来还会增加策略验证等能力。