端到端框架」共找到 3700 篇相关文章

算法论文8

Adobe 新研究:不用再「喂」训练数据,VLM 靠和自己玩游戏变聪明

Adobe 等机构研究人员提出「Vision-Zero」,借鉴 AlphaGo 自迭代方式,设计让 VLM 自我学习框架。此框架以类似「谁是卧底」游戏训练,不依赖标注数据,在多任务超越有标注的 SOTA 方法。

Founder Park
开源动态8

清华SageAttention3,FP4量化5倍加速!且首次支持8比特训练

清华大学陈键飞团队提出针对BlackWell架构的SageAttention3,实现5倍于FlashAttention的推理加速,首次支持8比特训练。在多种大模型上保持精度,代码将分别于6、7月开源。

机器之心
算法论文8

谷歌之后,英伟达入局扩散大语言模型,Fast-dLLM推理速度狂飙27.6倍

大语言模型领域,推理效率制约实际应用。谷歌Gemini diffusion曾展扩散模型并行潜力,但开源扩散LLM推理慢。近日,NVIDIA等推出Fast - dLLM,无需训练即插即用,推理速度狂飙27.6倍,兼顾速度与精度。

机器之心
新闻资讯7

Palo Alto5亿美元收购的Portect AI都有什么产品和技术?

2025年4月25日,Palo Alto Networks超5亿美元收购Protect AI,为客户提供人工智能安全保障。Protect AI有两个开源软件ModalScan、LLM Guard和三个平台产品Gardian、Recon、Layer,防护方案完整。

AI与安全
产品应用7

第九章 编码 Agent 实战——用 Deep Agents 构建代码审查助手

文章介绍用 `deepagents` 框架构建代码审查 Agent 的实战项目。此框架封装重复工作,让开发者专注业务逻辑。文中讲解其安装、最小运行示例,还介绍自定义工具及添加审查标准技能的方法。

CourseAI
算法论文8

NeurIPS25高分论文|以判别式监督学习强化推理LLM,解决难度偏差和熵崩塌难题

德州农工大学博士生李港在NeurIPS25高分论文中,分析GRPO优化目标,发现难度偏差局限及与判别式监督学习联系,提出DisCO框架强化大型推理模型,其优势显著,实验表现优于GRPO及其变体。

机器之心
算法论文8

跨层压缩隐藏状态同时加速TTFT和压缩KV cache!

论文 UNCOMP 被 EMNLP 2025 主会接收,提出高效推理框架,用截断矩阵熵解释 LLM 稀疏化,据此设计 UNCOMP 框架,通过压缩隐藏状态优化 KV Cache,实现计算与内存联合优化,实验效果显著。

机器之心
开源动态8

GitHub 爆火,这才是 Vibe Coding 的正确打开方式!

现在AI编程火,但很多人零基础不知咋上手。Github上的`easy-vibe`项目把「AI编程」从入门实战讲透,教从想法产品,有零基础出活、分层学习等亮点,覆盖开发完整链路。

开源先锋
产品应用8

阿里发布新版 Qoder:做每个人的编程智能体工作台,一手实测!

本文是对阿里新版Qoder的一手实测,新版Qoder从面向专业开发者的AI IDE,转型为面向全岗位的编程智能体工作台,支持自定义模型,探讨了AI Agent下半场的竞争方向。

特工宇宙
推荐文章8

对话涌生智能杨梦:AI for Bio的下一场竞争,是把实验闭环验证真正做出来

随着科技巨头进入生命科学领域,AI for Bio竞争升级,焦点转向模型能否进入科研流程。涌生智能与上海人工智能实验室发布成果,为跨越鸿沟提供新路径。对话涌生智能杨梦,探讨相关技术路径、产业思考等。

DeepTech深科技