「实时编辑」共找到 566 篇相关文章
中大 × MBZUAI重磅开源!A₁:全透明高效 VLA 模型,机器人实时控制成本直降 76% 丨CVPR 2026 Findings
开放世界机器人操作被大模型算力成本和推理延迟难题困住,中大与MBZUAI团队推出全开源的A₁模型,其自适应推理方案降低推理延迟和骨干计算量,性能超主流基线,打破‘高性能=高成本’魔咒。
登顶全球权威榜单!浙大创业团队百卡打造开源实时世界模型,视频秒变可交互4D世界
全球科技界正豪赌「世界模型」,但主流模型多停留在「视觉生成」。中国影溯公司发布并开源世界模型 InSpatio - World,综合性能优异,以小博大登顶权威榜单,降低了物理世界数字化门槛,引发行业关注。
开源2天狂揽3.3K Star!超火的隐形AI桌面助手,实时捕捉屏幕与音频,生成结构化知识!
GitHub爆火的隐形AI桌面助手Glass,开源2天Star超3.3K。它由Pickle团队开发,能捕捉屏幕和音频活动,转化为结构化信息。适合会议记录等场景,有屏幕活动捕捉等核心能力,提供不同系统安装方式。
3.9K Star!Inkeep 把 AI 原生 Markdown 编辑器做成了开源项目!
Inkeep 团队开源 OpenKnowledge,这是真正为 AI 设计的知识库工具,已获 3.9K Star。它有所见即所得、AI 协作等亮点,还基于 Git 同步,保障数据安全,值得 Markdown 工具使用者关注。
2.6K Star!GitHub 上这个开源桌宠,用一只小螃蟹就能监控你的 AI 编程助手!
介绍开源桌宠 Clawd,它是为 AI 编程助手设计的实时状态监控器,有 12 种萌趣动画状态,支持 10+ 主流工具,具备权限审批等实用功能,零配置开箱即用。
最贵缩放录屏软件Screen Studio被这个开源项目复制了,完全免费!
Recordly是开源录屏与编辑工具,适用于演示等场景,支持多系统,比Screen Studio轻便顺滑还免费。有自动缩放等功能,介绍了安装、系统要求和使用方法。
OpenAI史上最快模型降临,每秒1000Token!代码从此「炸出来」
OpenAI发布GPT-5.3-Codex-Spark,它是专为实时编程设计的超高速模型,生成速度超每秒1000个token,联手Cerebras硬件,重写底座提升性能,在多项测试表现强,ChatGPT Pro用户可尝鲜。
西湖大学科研版NanoBanana开源!科研绘图从此自动化
西湖大学将科研版NanoBanana开源,其AutoFigure框架可自动化生成学术插图且能编辑,论文被ICLR 2026接收。该框架提出理性渲染范式,配套FigureBench基准测试集,表现超越人类预期。
图像、视频一模搞定!字节全能原生多模态本地可部署
字节开源原生多模态模型Lance,仅3B激活参数,40G显存就能跑,已登顶huggingface趋势榜。它能进行图像与视频的理解、生成、编辑等操作,在多个基准测试中表现优异,多项性能居首。
谷歌放大招了,开源命令行AI编程Agent,每天1000次免费调用,编程只是基础功能。
Google推出开源命令行AI编程Agent——Gemini CLI,基于Gemini 2.5 Pro模型,免费提供每日1000次调用额度。它不仅能编程,还具备多模态能力、实时信息整合等功能,支持定制与自动化。