多粒度编辑」共找到 4260 篇相关文章

开源动态8

GitHub 狂揽 12K Star!把 OpenClaw 以及所有 Code Agent 工具装进一个界面!

AionUi是本地优先、开源免费的AI Cowork平台,将散落终端的命令行AI工具统一到图形界面。它兼容主流工具,有统一平台、工具支持等特点,还具备任务并行等核心能力,适合Code Agent用户。

开源星探
开源动态8

千星项目LLMRouter:模型路由,16+策略优化推理

UIUC开源智能模型路由框架LLMRouter,可自动为大模型应用选最优模型,有16+路由策略。该框架打通训练、评测等链路,解耦Route与Training模块,支持轮协同等,还可插件式扩展。

新智元
开源动态7

支持持久化知识图谱!Agent协同的革命性框架

Agent - MCP 是为经验丰富的 AI 开发者设计的 Agent 协同框架,能解决传统 AI 开发难题。亮点有并行开发、持久化知识图谱和实时可视化协作,可让 Agent 高效协作,避免上下文丢失和任务冲突。

GitHubStore
产品应用7

Hexstrike AI在个工具及模型上的渗透测试表现

文章围绕Hexstrike AI在个工具及模型上的渗透测试展开。介绍测试环境,用不同难度靶机测试。分析Claude desktop+Sonnet 4.5、AIaW+Deepseek、Cursor+个模型等组合表现,指出LLM辅助渗透测试任重道远。

AI与安全
算法论文8

ICLR 2026 | CineTrans: 首个转场可控的镜头视频生成模型,打破闭源技术壁垒

随着视频生成模型发展,影视级长视频需镜头序列及自然转场,这成新挑战。上海人工智能实验室团队提出 CineTrans 模型,基于掩码机制实现自动化转场,还构建 Cine250K 数据集,实验效果超基线。

机器之心
开源动态8

谷歌AI Agent刚开源!任务智能体+MCP+谷歌搜索,狂揽9000颗星

今天凌晨,谷歌在官网开源AI Agent框架Gemini CLI,将Gemini大模型融入终端。它能调用视频和图像模型,集成MCP、谷歌搜索等功能,还集成超强编码助手,刚开源就在Github超9000颗星。

AIGC开放社区
开源动态8

浙大联手字节:开源大规模指令跟随视频编辑数据集OpenVE-3M

浙江大学与字节跳动合作,提出大规模指令跟随视频编辑数据集 OpenVE-3M,有 3M 样本对。还提出数据构造管线、编辑模型 OpenVE-Edit 及评测集 OpenVE-Bench,小参数量下超越现有开源模型。

机器之心
产品应用7

从补全到 Agentic Edit:Trae 在代码编辑上的落地与进化

AI 编程助手走向智能化,Trae 团队历经“补全 + Chat → Apply → Builder + Cue”三阶段,解决文件定位、跨文件修改等难题,介绍 Apply 与 Search/Replace 方案适用场景,还将从三方面继续探索。

InfoQ
产品应用8

超脑未来WorldDreamer V4横扫个权威榜单,世界模型进入群体智能时代

超脑未来发布 WorldDreamer V4,它以智能体为基本单位,具种核心能力。采用新预训练架构,引入 Masked Agent Modeling,用共享隐式世界状态带来新协同范式,还在权威榜单领先。

机器之心
开源动态8

还在花钱转语音?10,000+ star 开源「ebook2audiobook」白嫖1107种语言!免费文字秒变语言音频!

`ebook2audiobook` 是由 Drew Thomasson 主导、13k+ Stars 的开源工具,能将电子书无缝转换为有声书,支持 1107+ 语言,有章节拆分、 TTS 引擎支持等功能,低门槛部署,适合场景。

小华同学ai