「清华高性能所」共找到 3652 篇相关文章
EdgeClaw:把 Claude Code 体验带到 OpenClaw
EdgeClaw 由清华、人大、面壁智能联合打造,是开源 AI 助手。它让 OpenClaw 用户拥有 Claude Code 级长期记忆能力,有多层结构化长期记忆等核心功能,适用于大型代码库维护等场景,还给出了使用方法。
最低 306KB,这款低延迟语音检测神器太绝了!
语音交互中,VAD至关重要。新开源的TEN VAD能精准识别语音起止,是替代WebRTC VAD和Silero VAD的优选。它低延迟、高准确率、极致轻量,已被Kaldi集成,还能跨平台部署,使用方便。
腾讯开源全新动作迁移模型FlexiAct,人物 & 动物都支持
当前动作定制方法在应对多样化主体和场景时适应性差,清华与腾讯提出FlexiAct模型。它引入RefAdapter和FAE,能在空间结构差异大或跨域场景中精准适配动作,保持外观一致,表现优于其他方法。
让机器人学会手往哪儿伸、怎么操作,东大团队给了新解法
东南大学魏秀参团队提出 RAAP 解决具身智能领域可供性预测难题。它将 affordance 分解,设计互补推理机制,每任务仅需数十样本,已被 ICRA 2026 接收,实验显示其性能优于基线。
结构化扩展拿下Agent工具检索新SOTA,精准找到API|ICLR'26
宁波东方理工大学沈晓宇团队在ICLR 2026发表论文,指出当前工具检索瓶颈在于工具文档。提出对文档结构化扩展,再训练模型的方案,构建TOOL - REX等组件,实验显示显著提升检索性能。
震撼好莱坞,一天AI生成10部短片,Google神器比肩一个影视工作室
Google的AI视频神器Veo 3刷屏,使用门槛低,生成效率高,效果震撼。它能生成二次元、科幻、仙侠等多种类型短片,虽有不足,但极大促进AI视频发展,适合多行业基层人员。
手机跑多模态也能快到飞起!面壁MiniCPM-V 4.6开源
面壁智能开源多模态模型MiniCPM-V 4.6,以低算力成本、超低首Token延迟打通三大主流手机操作系统。它算力瘦身性能强,是视觉语言多面手,还适配主流系统,降本增效,让AI能力从云端到指尖。
LLM的“记忆外挂”来了!Supermemory新API:一行代码让LLM记忆“无限+省钱90%”
Supermemory公司发布Infinite Chat API,能让任何LLM有近乎无限上下文长度。用户一行代码就能切换,可扩展上下文、省90%成本、提性能,已上线,有免费试用额度,后续有固定费用和用量计费。
苹果AI选Mamba:Agent任务比Transformer更好
苹果新研究指出,在长任务、多交互的Agent式任务中,基于SSM架构的Mamba在效率与泛化能力上超Transformer。虽Mamba有局限性,但引入外部工具后性能显著提升。
CVPR 2026 Oral|告别模型合并冲突!南大等提出OrthoReg:极简正交正则化,揭开任务算术的底层机制
南京大学等团队为任务算术建立底层理论框架,提出「任务特征特化」属性,推导出几何约束方法OrthoReg。该方法引入极简正交正则化项,提升模型合并性能,论文被CVPR 2026接收并评为Oral,代码等已开源。