「机器学习工程代理」共找到 2231 篇相关文章
LightX2V Ulysses Attention 实现学习笔记
本文记录了LightX2V中Ulysses Attention的实现方式与张量形状推导。在多模态/视频场景,其实现可概括为一种layout变换,还提供`enable_head_parallel`和`use_fp8_comm`选项,效果受运行环境等因素影响。
一个人+Claude+云服务,相当于一整个工程团队
网上两个实操演示被疯转,一是Google Cloud工程师用Claude配合Google云部署应用;二是Anthropic Claude团队教搭建带持久记忆的AI智能体。博主整理7天实操计划,将Claude变“全自动AI雇员”,还介绍多种AI雇员类型及成本。
The Batch: 939 |在推理阶段学习长上下文
大型语言模型处理长上下文时通常准确性降低、速度变慢,研究人员提出TTT - E2E方法,通过推理时训练模型将上下文压缩到transformer权重中,还展示了其运作方式、测试结果等。
Agent上下文工程被Cursor玩出了新高度~
Cursor的agent为所有模型使用动态上下文,在保持质量时更智能填充上下文。代码Agent改变软件开发方式,Cursor提出动态上下文发现模式,介绍了在其中使用该模式的做法及优势。
2025 年 InfoQ 趋势报告:AI、ML 和数据工程
InfoQ AI ML 趋势报告基于编辑团队与嘉宾播客,总结 AI、ML 技术发展趋势。涵盖 AI 代理、多模态语言模型等创新领域,也提及早期采用者、早期多数、晚期多数类别的技术,还对 2025 年相关领域发展作出预测。
ChatGPT引爆教育革命,学习效果暴涨86.7%!
新智元报道,Nature子刊元分析汇总51项研究,揭示ChatGPT显著提升中小学生学业表现和高阶思维能力,不限学科和使用方式,还能减轻精神负担,但使用需家长和老师指导。
ACL 2026 | 腾讯混元Agents工具学习新范式
腾讯混元团队在 ACL 2026 Findings 发布的 ToolCPT 指出,Agent 用不好工具病根在预训练。它从真实代码挖工具,写说明书,融入预训练,实验显示能有效提升工具运用能力,但也有局限和成本。
AI编程学习:Chrome DevTools MCP 到底有多强?
作者体验了Google新出的Chrome DevTools MCP,它在小红书自动发帖、YouTube智能观看等场景表现出色。与Playwright对比,其Token消耗低、报错处理稳。还揭示设计思路差异,给出上车指南。
One RL to See Them All?一个强化学习统一视觉-语言任务!
国内初创公司 MiniMax 提出 V-Triune 系统,可让 VLM 单一训练流程学视觉推理和感知任务。它含三个组件与动态 IoU 奖励机制,基于此的 Orsta 模型在多项测试中性能提升显著,凸显统一 RL 方法有效性和可扩展性。
sglang 源码学习笔记(二)- backend & forward 过程
本文深入解析sglang forward核心实现全流程,介绍了forward传递过程、AttentionBackend数据结构,以flashinfer为例展开分析,还说明了cudaGraphRunner初始化、Capture、Replay过程,助读者理解代码。