「自注意力机制」共找到 1952 篇相关文章
用Claude Code剪视频,自动去口癖、加字幕、调色,完全免费开源
browser - use团队开源Claude Code技能video - use,可自动去口癖、加字幕、调色等。它通过转录文本和按需视觉合成图让LLM理解视频,有完整流水线和设计原则,还给出使用方法。
视频生成不再「断片」:OneStory给模型装上「选择性记忆」,跨镜头讲故事人物场景始终如一丨CVPR'26
多镜头视频生成挑战大,现有方法有局限。Meta与哥本哈根大学研究者提出OneStory,为多镜头视频生成建立跨镜头记忆机制,可生成连贯长视频,在复杂叙事中保持一致。
年轻人的第一个爱马仕
AI圈的Hermes是Nous Research开发的开源Agent框架,GitHub星数超35000。作者写76页《Hermes Agent从入门到精通》,介绍其设计思路、使用方法等,中英文版可在GitHub免费下载。
Anthropic 产品负责人:PRD 已死,原型万岁
Anthropic Claude Code 产品负责人 Cat Wu 指出,模型指数级进化,产品团队工作方式需重建。PM 不再写 PRD,而做原型、写 eval,团队用 Side Quest 机制,各角色工作本质合流。
从它石智航的世界纪录里,我看到了具身大模型落地干活的希望
在上海AWE展会,它石智航的A1机器人获“机器人在一小时内装配亚毫米级线束最多次数”吉尼斯世界纪录。这得益于它石自研通用具身大模型「AWE3.0」,该模型实现多项突破,推动具身智能落地。
郎园Station展讯|X美术馆新展预告:数字浮游——第六届北京电影学院国际新媒体艺术三年展巡回展
2026年3月7日至5月5日,X美术馆联合北京电影学院举办“数字浮游——第六届北京电影学院国际新媒体艺术三年展巡回展”。展览聚焦影像,汇集24位(组)艺术家26件作品,探讨数字时代创作机制。
辟谣丨谷爱凌并未加入风投机构 Benchmark,原图为 AI 捏造
2月13日,自媒体传播“谷爱凌加入风投机构Benchmark”,实则是假新闻,配图为AI捏造。背后是地缘政治黑色幽默,谷爱凌和Benchmark合伙人因“中国元素”遭美国强硬派舆论围攻。
别再让语音机器人“答非所问”:AI Force任务型语音对话技术总结
本文围绕企业级任务型语音Agent核心挑战,提出解决“拟人化”与“专业化”问题。介绍三段式语音对话解法、架构演进,还提及‘衍算’推理框架等技术及未来方向,团队来自蚂蚁集团AI force。
看到苹果和谷歌重磅联合声明的时候,我正在用 Gemini 写代码
苹果与谷歌达成合作,下一代Apple Foundation Models将基于Google的Gemini模型和云技术构建,为Apple Intelligence功能提供底层支撑。此前Apple Intelligence节奏慢、能力跳票,苹果或借Gemini补短板。
JetBrains放弃Fleet:急刹变道打造全新Agentic IDE,与VS Code、Cursor争夺下一代AI编程王座
本周,JetBrains 宣布停止开发 IDE 产品 Fleet,将精力投入新开发环境 Air。Fleet 自 2021 年推出一直处预览阶段,难取代 IntelliJ IDEA。公司称维持两条产品线易致用户困惑、分散精力。