「主动视频推理」共找到 3090 篇相关文章
第二代InfLLM开源,同尺寸快三倍!零参数,可训练稀疏注意力
新智元报道,清华、OpenBMB和哈工大提出零额外参数、训练高效的原生稀疏注意力框架InfLLM-V2,仅用5B长文本词元就能完成训练,相比稠密注意力机制有显著加速,性能接近传统稠密模型。
究竟会花落谁家?DeepSeek最新大模型瞄准了下一代国产AI芯片
近期,DeepSeek发布V3.1新模型,采用全新混合推理架构,在多任务表现上有提升。它采用UE8M0 FP8,或为国产推理芯片优化机制。国内多家厂商新一代AI芯片支持FP8,未来国产大模型或针对其专门优化。
是剧本杀来了?还是儿童剧本杀教育机会来了!
儿童剧本杀教育的兴起,不仅为孩子们提供了一种新颖的娱乐方式,也带来了教育的新机遇。它通过沉浸式体验,让孩子们在玩耍中学习历史,培养兴趣,同时满足了市场对创新教育内容的需求。
从李飞飞到朱军,世界模型为什么都开始走向机器人|甲子光年
本文报道近期多位AI领军者均将世界模型研究转向机器人领域,梳理了朱军团队通用世界模型的五级技术路线,解析世界模型从生成世界走向真实行动的核心逻辑与行业趋势。
本周推荐的6个超级6的Github开源项目!
本文推荐6个Github开源项目,包括Tabler(HTML仪表板UI工具包)、KrillinAI(AI视频工具)、Simple mind map(思维导图工具)、Sniffnet(网络流量监控工具)、Supabase(Firebase替代品)、FeHelper(开发者浏览器扩展),介绍了各项目特点与功能。
Anthropic说:Session Management 是最好用的 Harness Engineering!
Anthropic指出管理Session、Context等在Claude Code上已落地。模型上下文并非越长越好,rewind比纠错好,compact要把握时机,subagent可隔离上下文,如今行业看重agent产品runtime。
Claude Code 新增 Recap 功能,多开党必备神器
Anthropic更新Claude Code,新增Recap功能。切回窗口时,它自动显示摘要,告知操作进度、问题及下一步计划,解决多开党忘记进度的困扰,目前已在终端版上线。
PaperDebugger:开源的学术版Cursor
PaperDebugger是AI驱动的学术写作助手,能调试和改进论文,提供智能建议。它用基于MCP的编排引擎,模拟学术流程,有聊天、插入、评论等功能,只读取项目,保障隐私。
ICLR 2026 Oral | 告别多步去噪!清华团队推出MVP,实现机器人动作单步极速生成
清华大学智能驾驶课题组 iDLab 与加州大学伯克利分校人工智能研究院 BAIR联合发表研究,提出 MVP 策略。它引入瞬时速度约束解决均值流学习问题,设计复合生成与选择机制,在多任务测试中表现出色。
NVIDIA 李柏依:机器人只会「看」还不够,它还得学会「听」| ECCV 2026
本文整理了NVIDIA Research科学家李柏依在ECCV 2026 Workshop的分享,针对机器人训练数据采集壁垒高的问题,介绍了两项解决多模态感知与灵巧操作数据难题的前沿研究。