「AI辅助学习」共找到 10547 篇相关文章

算法论文8

超越免训练剪枝:LightVLA引入可微分token剪枝,首次实现VLA模型性能和效率的双重突破

文章介绍LightVLA框架,它是用于提升VLA推理效率和性能的视觉token剪枝框架。针对VLA模型计算开销大、推理延迟高问题,提出两大创新,在LIBERO实验中性能超经典模型,还实现推理加速。

机器之心
开源动态8

无需训练,即插即用:西湖大学发布世界模型WorldForge,让普通视频模型秒变「世界引擎」

自Sora亮相,AI视频可控性成瓶颈。西湖大学AGI实验室团队提出WorldForge框架,在推理时为视频模型注入「时空几何」,无需训练,实现单图360°环绕视频生成和视频重运镜等,降低创作门槛。

机器之心
推荐文章7

CuteDSL-1: Introduction

文章介绍CuteDSL,它因Cutlass编译慢、调试难等痛点而生,可在Python构建DSL,编译快、调试易且性能无损。文中阐述其架构、使用方法、与PyTorch集成优势等,还提及基于CuTe的开发及性能对比。

GiantPandaLLM
算法论文8

苹果传统强项再发力,视觉领域三种模态终于统一

苹果在大模型领域常受挫,但计算机视觉研究是其强项。其研究团队提出 ATOKEN,这是首个能在主要视觉模态统一处理的分词器,兼顾重建质量与语义理解,成果朝通用视觉表征迈进一步。

机器之心
产品应用7

MultiAgent架构实践:如何打造GitHub Stars 2.8k的ComfyUI-Copilot V2.0

ComfyUI是Stable Diffusion生态中可视化编程工具,但使用有难度。ComfyUI - Copilot V2.0基于多智能体协作框架构建,能实现对话开发、报错修复等功能,还介绍了其架构、技术栈及多智能体设计思路等。

开源星探
推荐文章7

从 Shopify 构建 Agent 的经验中可以学到的

Shopify 分享构建 Agent 经验,采用主流 Agentic Loop 架构。给出4条打造 AI 智能体核心建议,还指出工具控制在20个内,可用 SubAgent 分摊上下文;用人类标记结果作基准让 LLM 评估 Agent 生成结果。

宝玉AI
7

Android Studio 新功能上线,Compose 预览可调,开发者:终于不用盯着屏幕傻调尺寸了

最新发布的 Android Studio Narwhal 3 Feature Drop 带来功能增强,有可调整大小的 Compose 预览、新备份恢复工具等。支持 AGENTS.md 文件定制 Gemini 行为,还有图片附件和 @File Context 特性,提升 AI 集成与协同能力。

InfoQ
推荐文章7

虚拟智库:运用大语言模型获取多元视角

本文探讨如何用大语言模型(LLM)构建虚拟智库。以电商系统架构决策为例,通过让 LLM 扮演不同角色,如 Martin Fowler、David Heinemeier Hansson 等,从多元视角讨论微服务架构利弊,为架构决策提供参考。

InfoQ
新闻资讯7

美国政府变身英特尔最大股东,能帮它重新崛起吗?

路透社消息,美国政府与英特尔达成协议,将掏89亿美元买其4.333亿股普通股,占股9.9%,加上之前拨款,总投资达111亿美元。此交易引发各方争议,美国政府意在提升本土芯片制造能力。

AIGC开放社区
新闻资讯7

GPT-5“变笨”实锤,退休教授出了道井字棋送分题,结果它真送了

退休经济学教授用井字棋简单问题测试GPT - 5,其表现拉胯,与“博士级AI”宣传不符。后续操作离谱,或因OpenAI策略调整。此外,OpenAI在测ChatGPT新功能,奥特曼开始炒GPT - 6。

量子位