「代码编辑框架」共找到 3294 篇相关文章
开源8300小时标注数据,新一代实时通用游戏AI Pixel2Play发布
随着AI在代码和图片生成领域成熟,研究人员开始关注其在游戏领域的表现。此前的专用模型缺乏跨游戏泛化能力,通用模型在游戏环境中表现不佳。为此,Player2研究员提出Pixel2Play模型,还开源了代码和数据集。
英伟达&MIT等推出Long-RL,长视频训练速度翻倍
英伟达联合MIT等推出Long - RL,它是面向长序列推理和多模态强化学习的全栈训练框架,能提升RL训练数据长度上限,让训练速度翻倍。其核心MR - SP并行框架可降低训练耗时和显存,LongVILA - R1是其明星应用。
引入小目标注意力模块改进YOLO12用于无人机视角下的岸边人员玩水检测
文章介绍用小目标注意力模块改进YOLO12,用于无人机视角下岸边人员玩水检测。先介绍YOLO12特点与结构,再说明小目标注意力模块CBAM优势、流程及代码,接着阐述改进方法、数据集情况,最后给出训练和测试模型的代码与结果。
3.9K Star!Inkeep 把 AI 原生 Markdown 编辑器做成了开源项目!
Inkeep 团队开源 OpenKnowledge,这是真正为 AI 设计的知识库工具,已获 3.9K Star。它有所见即所得、AI 协作等亮点,还基于 Git 同步,保障数据安全,值得 Markdown 工具使用者关注。
【7.2K Star】Google 基于LangGraph打造全栈Deep Research
谷歌开源Deep Research全栈应用,前端用React(with Vite)和Shadcn UI,后端研究代理用LangGraph,需Redis和Postgres数据库,LLM用Google Gemini,网络搜索用Google Search API,还介绍了Agent执行流程。
Anthropic重磅更新skill-creator:创建skill全面告别“草台班子”时代
Anthropic升级skill - creator,让普通人创建skill更友好且有效。将测试等机制引入创作,能验证skill有效性。还支持多智能体并行测试、A/B测试,优化触发描述,为未来自然语言定义skill过渡。
一个只有70行的文件,凭什么拿下GitHub 10万星?
GitHub上‘andrej - karpathy - skills’项目爆火,核心是不到70行的CLAUDE.md文件,给出AI编程助手行为准则。其火的原因有解决痛点、名人背书等,价值在于证明‘上下文工程’重要。
5000 star,Harness门槛被OpenHarness打穿了
分享开源Python实现版本OpenHarness,它易上手,能助研究者和开发者理解生产级AI Agent原理、构建专用智能体。介绍其核心功能、架构及核心循环逻辑,还给出了Github链接。
OmniInsert:全新无掩码视频插入技术
基于扩散模型的视频插入技术发展快,但以往方法有局限。字节提出InsertPipe和OmniInsert,解决数据不足等难题。OmniInsert设计巧妙,还建立评测平台InsertBench,虽有小问题,但推理快,可加速优化。
6.2k 谷歌开源LangExtract,主打精确溯源的长文档抽取
谷歌开源 Python 库 LangExtract,能让 LLM 依用户指令从非结构化文档提取结构化信息。它可处理临床记录等,具备精确源接地、可靠输出等特性,支持多模型,无需微调,适用于各领域。