「端到端加速」共找到 2816 篇相关文章
离谱,偶然发现一个逆天MCP...
作者偶然发现滴滴入局打车MCP,用其接入苹果打造能通过Siri用嘴打车的Agent。介绍了将滴滴MCP接入Claude Code、Fastgpt、n8n等工具的过程,还分享用Siri实现嘴打车的流程,认为其填补AI打车空白。
多模态卷王阶跃星辰Step 3登场,推理效率可达DeepSeek-R1 300%
新一代多模态推理基模Step 3登场,它采用原创MFA架构,具“多开好省”亮点,推理效率高、性价比优。7月31日将开源,能适配各芯片,还发起“模芯生态创新联盟”推动应用落地。
1万tokens是检验长文本的新基准,超过后18款大模型集体失智
Chroma团队研究发现,将上下文扩展至1万tokens,18款主流大模型集体“失智”,“智商”非均匀下降,在一些节点会断崖式下跌。研究还设计四项对照实验,证明LLMs性能随输入长度增加显著且非均匀下降。
微软研究院BioEmu登上Science,用生成式AI重塑蛋白质功能研究
7月10日,微软研究院AI for Science团队在《Science》发表成果,提出生成式深度学习模型BioEmu,结合多类数据训练,能模拟蛋白构象变化,有多项核心创新,已开源,未来将拓展应用场景。
Sam Altman最新采访:我们即将破解超级智能,但社会可能依然糟糕,人形机器人是终极梦想
Sam Altman在访谈中分享对未来5到10年AI见解,涉及AI发现新科学、人形机器人、超级智能悖论等,还谈到OpenAI蓝图、能源供应及行业竞争,爆料扎克伯格天价挖人。
苹果AI 路线图曝光:从未打算开发聊天机器人
苹果软件工程高级副总裁Craig Federighi在WWDC 2025表明,苹果从未打算开发聊天机器人,而是要将智能深度整合到所有平台体验中,实现环境智能,此言论引发网友热议。
MetaShuffling:Meta的Fused MoE kernel工程方案,更激进的Kernel优化和尽量避免Padding
文章介绍Meta的Fused MoE kernel工程方案MetaShuffling,可高效部署Llama 4模型。它处理MoE推理挑战,介绍多种token选择路由方案,阐述运行时设计、不同并行化方式及优化思路,还展示性能测试与Trace分析。
阿里通义发布并行计算新策略:1.6B等效4.4B,内存消耗骤降95%
阿里通义团队提出PARSCALE并行计算新策略,受CFG双路径推理机制启发,将并行思想扩展到训练和推理全流程。能让1.6B模型性能接近4.4B模型,内存占用大降,还可用于现有模型,无需从头训练。
YOLOv8 模型训练入门指南:手把手搞定目标检测AI
本文是从零训练 YOLOv8 模型的完整实录,介绍了 YOLOv8 特点,以“识别猫”为例,详述训练步骤,指出训练难点,还推荐学习资源与工具,鼓励前端程序员尝试做 AI 模型训练。
AI4S开始进入「项目时代」:紫东太初把AI从做Task推向做Project
AI for Science进入新阶段,中科紫东太初旗下ScienceClaw升级,推出AutoProject引擎,让AI从执行Task转向做Project,具备规划、执行、验证等项目级自主科研能力,推动行业范式升级。