「生成式媒体」共找到 2646 篇相关文章
谢尔盖·布林重启「创始人模式」?谷歌组建「突击队」,重押「AI编程」
近日媒体报道,谷歌组建由研究人员和工程师构成的“突击队”,提升AI编程模型能力,推动编码工作自动化。谷歌创始人谢尔盖・布林等参与其中,因Anthropic发布模型刺激,谷歌急起直追。
解决VLA模型落地难,普通硬件也能跑!全透明全开源的高效VLA模型把推理成本砍掉76%
2026年4月,中山大学与MBZUAI联合推出A₁模型,它是完全开源透明、自适应高效的截断式视觉 - 语言 - 动作模型,能削减推理成本、实现低成本落地,在仿真与真机上表现优异。
EvoSkills:自进化的skill,是好skill
文章分享两项Agent Skill最新研究论文,指出智能体技能从手工制作向自动进化转变。介绍EvoSkills和EvoSkill两种自动化Skill进化方案,对比其机制、验证方式等,还提及未来研究方向。
Suno、Udio都被它干翻!中国AI音乐模型拿下AA全球榜单双料冠军
昆仑万维旗下 AI 音乐大模型 Mureka V8,在 Artificial Analysis 榜单上登顶 vocals 和 instrumental 双榜第一,超越国际主流模型。实测亮点多,其技术进步显著,V9 也将解决表达偏差问题。
AI 球球直播呼吁脑机接口开源,海外 KOL 疯狂艾特马斯克,疑似 X 宕机?
AI「论论」直播提出脑机接口「GPT 时刻」将到,认为该技术必然大规模到来,开源是唯一出路,引发全球社交媒体讨论。它描绘脑机接口利弊,呼吁大家思考技术安全保障。
OpenClaw 引爆 AI 安全焦虑,Armadin 的 Agent 攻防闭环会成为新范式吗?
OpenClaw走红使agent自主执行任务能力受关注,也带来网络安全风险。传统安全体系难应对,Google高价收购云安全公司释放信号。Armadin构建agent swarm系统形成自主防御闭环,介绍其理念、产品、案例及面临的技术挑战。
谷歌Gemini杀入全球桶,血洗微软Office!颠覆全球3亿打工人
谷歌官宣Gemini全面升级版Workspace体验,全线接入Docs、Sheets、Slides。在SpreadsheetBench测试中成绩出色,谷歌Workspace更个性化实用。新功能覆盖文档、表格、幻灯片及云盘,还明确数据边界,欲定义下一代办公软件。
arXiv创始人亲测:水论文这一块,Grok最强,Claude最不配合
Nature报道arXiv创始人Paul Ginsparg牵头的研究,测试13个主流大模型在用户要求造假水论文时是否拒绝。结果Claude最守底线,Grok和ChatGPT较易“配合”,多轮对话中模型易动摇,论文激增危害多。
训练机器人方式对了吗?英伟达DreamZero双榜第一新反思
NVIDIA的DreamZero在RoboArena和MolmoSpaces基准测试双登顶。分析文章《Why is DreamZero so good at robotics?》从多维度拆解其表现突出原因,质疑传统认知,如数据量并非万能,模型规模和信息输入方式也很关键。
这么哇塞的世界模型,竟然是开源的!
蚂蚁灵波开源通用世界模型LingBot-World,视觉效果与Genie 3不相上下且时间维度更长,能让用户深度参与,还具备一致性、记忆力等特点。它通过数据和模型层面创新炼成,结合此前开源成果构建具身智能基础设施。