麦琪的花园」共找到 10488 篇相关文章

产品应用8

AI 集成智能 Profiling 实践:从性能分析到优化闭环

本文由韩钦亭撰写,分享了在已有 Profiling 平台引入 AI 智能辅助模块实践。介绍了设计思路、工程实现、应用成效,对比不同大语言模型,通过实际案例展示优化效果,还探讨了 AI 在性能优化场景未来潜力。

InfoQ
开源动态8

没想到,最Open开源新模型,来自小红书

向来低调小红书昨日开源首个自研大模型 dots.llm1,它是中等规模 MoE 模型,在较小激活量下性能良好。其开源力度堪称行业最大,还介绍了数据处理、训练优化等多方面技术细节。

机器之心
算法论文8

年前看到最有深度AI下半场Agents记忆机制综述

本文是一篇83页基础智能体记忆机制综述,由27家机构联合发表。提出AI研究范式转变,记忆是填补理想与现实差距关键。构建三维统一分类框架,介绍记忆操作、学习策略、评估体系、应用场景及未来方向。

PaperAgent
算法论文8

马斯克惊叹!DeepSeek和Kimi先后出手,捅破了Transformer「潜规则」!

文章介绍了DeepSeek和Kimi在残差连接上突破。DeepSeek让连接权重可学习,用数学约束保证稳定性;Kimi将注意力机制用于层间连接,解决了更根本问题,性能提升显著。

花叔
算法论文8

将注意力旋转 90 度!今天,Kimi 「注意力残差」火了

Kimi团队发布技术报告Attention Residuals,用依赖输入注意力机制取代标准深度递归,解决传统残差连接信息稀释和隐藏状态爆炸问题。实验显示其有计算优势,下游任务表现佳。

机器之心
产品应用7

深入体验 A2A SDK:一步步教你构建“服务化” Agent 系统

文章基于A2A最新Python - SDK,介绍将LangGraphAgent通过A2A协议对外暴露并服务方法,涵盖核心架构、概念、交互流程,以及A2A Server端、Client端实现和测试总结,还提及A2A优势。

AI大模型应用实践
推荐文章8

如何正确Vibe Coding?这是来自Anthropic编程智能体负责人大师课

Anthropic研究员Erik Schluntz分享Vibe Coding经验。他认为AI能力指数级增长,开发者应接纳大模型生成系统,还提出聚焦‘叶子节点’、做好产品经理等策略,并介绍22000行代码合并案例及实战问答。

机器之心
开源动态8

PyTorch博客翻译 Accelerating Generative AI Part III: Diffusion, Fast

这篇博客介绍用纯原生 PyTorch 技术将文本到图像 diffusion 模型(特别是 Stable Diffusion XL)推理速度提升高达 3 倍方法,讲解五种优化技术,还验证了方法在其他 diffusion 模型上通用性和有效性。

GiantPandaLLM
新闻资讯7

17 万模型背后:魔搭联合 AMD 送 1000 小时 GPU 算盘

魔搭社区联合 AMD 推出「AMD 开发者激励计划」,提供最高 1000 小时 GPU 算力额度。魔搭社区对标 Hugging Face,托管超 17 万个开源模型。此次激励是三方匹配生意,还释放了硬件去美元化和模型托管社区升级信号。

AI Reading Hub
产品应用8

一款产品,同时为人类和 Agent 设计,LibTV 是怎么做

3月18日,LiblibAI旗下AI视频创作平台LibTV上线,它从设计之初就兼顾人类创作者和Agent。创作者端工作流画布可控;Agent端可通过Skill接口创作,交付可编辑项目。该产品还针对两者差异做了设计,价格也便宜。

Founder Park