「视频应用」共找到 3035 篇相关文章
The Batch: 949 | 人形机器人进入工厂车间
少量人形机器人已进入工业场景,成本接近人力成本。Agility Robotics向Schaeffler提供Digit机器人,负责搬运箱子。目前工业人形机器人应用有限,多处于试点,预计到2040年数量将大增。
字节开源了一个了不得的模型!
字节跳动开源统一多模态基础模型BAGEL,一个模型能同时理解和生成文本、图像、视频。部署测试有亮点但效果不稳定,还分享该模型体验Demo、地址及安装使用教程。
本周5个yyds的Github开源项目,速速收藏!
文章介绍本周5个Github优质开源项目。有基于云服务的CloudPaste,排版强的Quarkdown,视频下载工具Media Downloader,双语翻译插件FluentRead,还有全能安卓助手LinkAndroid,各有特色功能。
首篇,系统盘点扩散模型高危漏洞!看懂攻击方式和防御体系
随着扩散模型广泛应用,其安全问题凸显。天津大学团队论文系统梳理文生图模型攻击方式、风险类型、威胁场景与防御体系,指出当前防御不足,需建立更体系化防护体系。
别难为 ChatGPT 了!面对海量资料,NotebookLM + Gemini 的“外挂模式”才是降维打击
Google打通NotebookLM和Gemini后,二者协作效果出色。NotebookLM可拆解复杂信息,Gemini以其为参考数据源答案更精准。二者还能基于笔记本做网站、视频、图片等,各有优势、双向协作。
Grab 工程实践:将 LRU 升级为 TLRU,Android 图片缓存节省 50MB+
为改进 Android 应用图片缓存管理,Grab 工程师将 LRU 升级为 TLRU。通过引入基于时间的过期机制,fork Glide 项目扩展 DiskLruCache 实现。此方案让 95% 用户缓存省 50MB,可回收数 TB 存储空间。
24个Agent工作流框架用哪个? 11个维度全面评测
LLM发展推动自然语言理解进步,国产LLM密集发布。文章从功能能力和架构特性两维度,对24个智能体工作流框架全面评测,给出关键结论,还提及优化策略、应用领域等。
ECCV 2026 | 智能助手何时该主动开口?Vinci2让第一视角AI助手从「有问必答」走向「主动服务」
现有第一人称视频助手难以自主判断何时介入服务用户。大连理工大学等团队提出Vinci2,含评测基准EgoServe和智能体EgoMemo。它已被ECCV 2026接收,代码和标注均开源。
Codex 独立 App 来了,这是一个新东西
OpenAI 推出 Codex 独立桌面应用,或改变 AI 编码方式。它是 Agent 的指挥中心,有 Worktree、Skills、Automations 等功能,支持双个性模式和安全沙箱,限时开放且付费用户额度翻倍。
逛完WAIC,我们发现这家芯企已经把端侧AI“场景落地”做实
7月17 - 20日,世界人工智能大会召开,端侧AI成热点。瑞芯微展台展示大模型、Agent、AI+应用,多方案已量产落地,其双轨架构优势突出,还规划了产品路线图。