「视频分析」共找到 2029 篇相关文章
字节开源了一个了不得的模型!
字节跳动开源统一多模态基础模型BAGEL,一个模型能同时理解和生成文本、图像、视频。部署测试有亮点但效果不稳定,还分享该模型体验Demo、地址及安装使用教程。
本周5个yyds的Github开源项目,速速收藏!
文章介绍本周5个Github优质开源项目。有基于云服务的CloudPaste,排版强的Quarkdown,视频下载工具Media Downloader,双语翻译插件FluentRead,还有全能安卓助手LinkAndroid,各有特色功能。
别难为 ChatGPT 了!面对海量资料,NotebookLM + Gemini 的“外挂模式”才是降维打击
Google打通NotebookLM和Gemini后,二者协作效果出色。NotebookLM可拆解复杂信息,Gemini以其为参考数据源答案更精准。二者还能基于笔记本做网站、视频、图片等,各有优势、双向协作。
从写清 Spec 到看懂功能:在 Session 历史中使用 Routa 重建需求全景
文章指出在AI Coding中,Spec负责定义需求起点,大量实现走向内容留在Agent的session历史里。介绍了如何通过Feature Explorer将Spec和Session历史重新组织,让Agent基于功能证据分析,使项目保持整体性。
斩获4.1K star,再见tcpdump!这款开源神器让网络分析快如闪电!
Kyanos是基于eBPF技术的开源网络分析工具,能透视Linux内核网络活动,解决分布式系统网络难题。它零配置、有内核级透视和智能流量解密能力,功能丰富,应用场景广,相比同类优势明显。
ECCV 2026 | 智能助手何时该主动开口?Vinci2让第一视角AI助手从「有问必答」走向「主动服务」
现有第一人称视频助手难以自主判断何时介入服务用户。大连理工大学等团队提出Vinci2,含评测基准EgoServe和智能体EgoMemo。它已被ECCV 2026接收,代码和标注均开源。
大规模工程支撑场景下的多智能体系统设计:Grab 实践案例
Grab分析数据仓库(ADW)团队推出多智能体AI系统,处理数据仓库故障排查等工程请求,减少重复性运维。团队搭建多智能体架构,整合工具生态,考虑安全治理,解决上下文管理挑战,提升工作效率。
Agent经济,要来了
红杉资本半小时演讲讲清AI产业现状与趋势。介绍了分析框架,指出AI浪潮大且猛,会颠覆软件市场,机会在应用层。还提出Agent经济概念,建议大家抓住机会行动起来。
陶哲轩重写20年本科经典教材!Lean编程数学证明,GitHub已放出
陶哲轩迷上形式化数学证明,开设YouTube账号分享用Lean形式化证明的视频,还发布开源项目,将经典教材《Analysis I》定义、定理和习题「翻译」成Lean代码,项目可作学习资料,部分内容已完成翻译。
开源一个拯救你旅行废片的 Skill
作者因旅行照片不尽人意,开发开源 Skill Yingzao · 营造。它风格多样、能检索文化背景,可进行原图对比拼图、多图融合等,适用场景广,还能生成视频,工作方式独特。