「可动物体生成」共找到 5509 篇相关文章
The Batch: 969 | 谷歌的机器人模型有了腿
谷歌发布 Gemini Robotics 2(GR2),能将相机图像和文字指令转为机器人关节控制命令,可同时控制人形机器人腿、躯干、手臂和手部,简化模型训练和设计,不过谷歌未公布其基础模型等信息。
突破万次连续编辑极限!中科院提出首个理论保稳的知识保留方法
中科院信工所研究人员提出LyapLock,将连续编辑建模为受约束随机规划问题,整合排队论和李雅普诺夫优化。实验显示,它能突破万次连续编辑极限,编辑效果比主流方法提升11.89%,还可赋能现有模型。
一人干翻所有大厂!OpenClaw硅谷封神,开发者一夜爆赚两亿
OpenClaw之父成硅谷英雄,其在YC访谈揭秘爆款AI背后故事。开发者用它结合TikTok实现财富暴增。Peter Steinberger称未来80%App将被取代,OpenClaw可本地运行,能连接设备,且记忆存本地,夺回数据主权。
DeepSeek深夜炸场,开源了一个新项目&论文,V4打前站?
凌晨,DeepSeek开源新项目Engram并公开论文。Engram用可扩展的O(1) N - gram记忆替Transformer早期层节省算力,在多方面实验表现出色,如推理任务增幅大于知识任务,还分析了其机理和系统效率。
从「会表演」到「更会演」:KlingAvatar2.0让数字人拥有生动灵魂
近日快手可灵团队发布 KlingAvatar2.0 技术报告,数字人能‘生动表达’。它有三大创新技术,如时空级联框架等。实验显示其生动性大幅提升,性能超竞品,推动数字人在多领域规模化应用。
八年后,Meta教会了Transformer「显式思考」
10月20日Meta上线新论文《The Free Transformer》,作者François重写Transformer思维方式,造出Free Transformer新架构。它在解码器内加入随机潜在变量,让模型生成内容前先‘思考’,实验显示在多任务上性能显著提升。
The Batch: 884 | Transformer获得新能量
弗吉尼亚大学等机构的研究人员提出 Energy-Based Transformer(EBT),它能检查自身输出。训练时通过能量值优化预测概率向量,测试显示其泛化优但生成特定文本差,扩展性好,为高性能带来新可能。
“分身术”来了!MANA创作者扶持计划带你走进MUMA Island的未来分身实验
文章介绍数字时代“分身术”,它是身份与叙事实验。从概念源流到技术支撑展开阐述,MUMA Island打造“三式分身”创作矩阵,MANA创作者扶持计划重视该项目,有前沿性、可复制性和社会价值,还公布活动信息。
融云首发“通信+AI”闭环架构,让 AI 有情商、能落地|甲子光年
8月28日融云在AIM线上发布会推出“通信+AI”产品矩阵,围绕“能落地的好AI”理念打造高情商AI。通信与AI相互增强,构建四层知识体系数字分身,其产品可解决多场景痛点,还能降低开发门槛。
天工Skywork开始"看"小红书了,1247个帖子的图片信息被它吃透!
昆仑万维技术发布周推出Skywork Deep Research Agent v2。它整合多模态检索理解和跨模态生成能力,有信息检索、小红书Agent等功能,Office Agent也有升级,还新增积分预估等特性,邀测后将全量开放。