「场景化技术共建」共找到 4402 篇相关文章
单卡2秒生成一个视频!清华联手生数开源TurboDiffusion,视频DeepSeek时刻来了
清华大学TSAIL实验室和生数科技联合开源视频生成加速新框架TurboDiffusion,能让视频生成在保证质量下最高提速200多倍,单张显卡就能运行,还整合四项关键技术,有诸多应用意义。
这可能是我见过最“接地气”的 AI 科普:从家政阿姨看懂 Agent 和 MCP
作者以家政阿姨打扫卫生为例科普AI名词,如阿姨比作AI Agent,扫地机器人是SubAgent,智能家居协议对应MCP,《家政技能手册》为Skills,借此辅助解释常见AI概念,助读者理解。
每周产业洞察 | AI音视频赛道现“隐形冠军”小众需求催生健康商业模式,工程能力成盈利分水岭
北京AIGC视听产业创新中心位于朝阳区,是朝阳区推动影视制作基地建设举措。由多方参与,首创郎园运营,提供六大服务平台,截至2025年8月汇聚60余家合作伙伴。首创郎园拓展服务边界,项目延伸多地。
刚刚,OpenAI开源了两个大模型~
OpenAI开源基于GPT - OSS的安全推理模型GPT - OSS - Safeguard - 120B和GPT - OSS - Safeguard - 20B,用于安全用例。有安全推理训练、自带策略等亮点,适配不同显存,采用宽松许可证。
突发!Claude 4.5 发布,这次更新不止是模型!
Anthropic发布Claude 4.5,在编程等任务中表现优于GPT - 5。Claude Code升级,API添新功能,模型能力提升,对齐性改善。还推出Claude Agent SDK及“Imagine with Claude”功能。
开源AI浏览器自动化框架!14.3K+ Star,自然语言+代码,爬虫效率翻倍!
传统浏览器自动化工具维护成本高,全AI代理缺乏可控性。Stagehand是Browserbase开发的开源AI浏览器自动化框架,结合自然语言和代码控制,有多种核心功能,获14.3K+ GitHub Star。
DeepMind让AI当「上帝」,导演一场只有AI演员的「西部世界」
Google DeepMind和多伦多大学研究人员受TTRPG和现代游戏引擎启发,提出Concordia软件库。它基于「实体 - 组件」架构,将工程师与设计师角色分开,能灵活构建多角色生成式AI系统,满足不同需求。
单卡搞定万帧视频理解!智源研究院开源轻量级超长视频理解模型Video-XL-2
智源研究院联合上海交通大学等机构发布新一代超长视频理解模型Video-XL-2。它单卡能处理万帧视频,编码2048帧仅需12秒,在效果、长度和速度上全面优化,已开放模型权重。
聚焦物理智能最前沿,PAIR首届年度会议即将开启!
当大模型能理解语言与图像,‘物理智能’指向智能从比特到原子的跨越。2026 年 9 月 20 - 21 日,上海物理智能与机器人研究院将主办‘PAIR Conference 2026’,设主题学术和商业闭门会议。
刚刚开源就斩获 2.7K Star!吴恩达老师开源了一个 AI 员工 OpenWorker!
吴恩达老师开源了桌面 AI Agent OpenWorker,对标闭源 Agent。它能交付成品,本地优先、支持多模型,重要动作需审批。有 25+ 连接器,支持定时任务和角色模板,提供多方式上手。