「高性能框架」共找到 4563 篇相关文章
科研人有自己的“吃虾”方式!斯坦福普林斯顿最新开源,仅需一行指令
斯坦福和普林斯顿高校团队开源“科研版龙虾”LabClaw,只需一行命令就能调动。它是AI的“技能包”,还能部署成AI实验室助手。此外还配操作系统LabOS,人机协作效率高,扩展性好。
Gemini 3「开眼」像素级操控!谷歌回应DeepSeek-OCR2
Google DeepMind为Gemini 3 Flash推出Agentic Vision,让模型主动编代码操控图像,性能提升5% - 10%。该能力已上线,谷歌还计划扩展功能。这或许是受DeepSeek-OCR2刺激,两者技术路线不同。
Claude Cowork 解读和 Open-Cowork开源实现
Claude Cowork是Anthropic推出的AI工作代理工具,可操作文件、执行长期任务,现处研究预览阶段。因使用门槛高,GitHub出现开源项目Open - Cowork,零代码门槛、多模型支持,有文件管理等功能。
AAAI 2026 | 革新电影配音工业流程:AI首次学会「导演-演员」配音协作模式
现有AI配音缺“人情味”,因跳过“导戏”“揣摩”环节。内蒙古大学刘瑞教授团队在AAAI 2026提出Authentic - Dubber框架,模拟真实配音流程,实验显示其情感表达优势明显,提升了AI配音竞争维度。
Meta这两篇最新Agent Learning论文,有些意思!
分享Meta SuperLabs两篇Agent Learning论文,从‘如何低成本获得高质量经验’出发,形成技术链,为语言智能体进入‘规模化RL时代’提供路线图,还分析了Agent RL问题及两论文成果、对比。
5.8K Star爆火!!在终端里开网页、刷视频、玩游戏,这操作真绝了!
介绍开源工具`term.everything`,它能在终端运行任何GUI应用,像浏览器、游戏等。该项目在GitHub获5.8K star,支持X11和Wayland应用,可远程使用,但画质和性能有局限。
从第一性原理出发的RAG推理新范式来了,蚂蚁DIVER登顶权威基准
当前RAG系统处理多步逻辑推理任务有局限,蚂蚁集团团队提出DIVER框架解决推理密集型检索难题。它将检索任务分四阶段,在BRIGHT榜单领先,行业对比优势明显,医疗应用效果好。
一文读懂:数据中心“拥抱”ARM架构,为何如此艰难?
文章探讨企业数据中心采用ARM架构面临的难题。如现有x86架构主导,切换有兼容性问题;ARM硬件选择有限、性能不足;云服务功能难对等;软件支持和许可证问题也阻碍其应用。
自回归模型杀回图像生成!实现像素级精准控制,比Diffusion更高效可控
当下AI图像生成领域,Diffusion模型虽为主流,但在精准控制上有不足。伊利诺伊大学香槟分校等机构研究者提出MENTOR框架,用自回归模型实现像素级精准控制,比Diffusion更高效可控。
ParScale:一种全新的大模型Scaling Law
文章提出并行扩展(ParScale)路线,在不增模型参数下,通过引入并行流提升性能。新扩展定律打破传统范式,两阶段后训练策略降成本,还适用于边缘设备,研究仍在进行。