单文件架构」共找到 2490 篇相关文章

产品应用7

谷歌推出 Conductor:一款面向 Gemini CLI 的上下文驱动开发扩展

谷歌发布新的 Gemini CLI 预览扩展 Conductor,为 AI 辅助软件开发引入结构化、上下文驱动方法,解决跨会话丢失项目上下文问题。它将开发上下文存于持久 Markdown 文件,支持团队配置,还强调规划优先工作流。

InfoQ
新闻资讯8

Transformer亲爹痛斥:当前AI陷死胡同,微调纯属浪费时间!

Sakana AI创始人Llion Jones是Transformer发明者之一,他警告当前Transformer虽成功,但业界或重蹈RNN覆辙,无数微调是浪费时间。他认为现在LLM非通用智能,已转向探索生物学启发的新架构

新智元
开源动态8

阿里又上新!开源 7B 文生图模型,专治图中文字,效果媲美 20B+ 大模型!

阿里 AIDC - AI 团队开源 7B 参数文生图模型 Ovis - Image,主打图中文字生成。它文本渲染能力强,在权威榜成绩好,媲美 20B + 大模型,官方还提供使用方法,是设计类刚需模型。

开源星探
新闻资讯7

快手高级副总裁盖坤兼任可灵AI技术部负责人

8月15日,快手发布组织架构调整公告,高级副总裁盖坤兼任可灵AI技术部负责人。他科研实力强,带领团队推出可灵AI。该模型迭代超30次,有大量用户和企业客户,战略地位不断提升。

AI科技评论
开源动态8

源神阿里!图像生成Ovis-Image再开源,7B小参数媲美GPT-4o和20B开源模型

阿里Ovis团队发布Ovis - Image,7B参数文本到图像模型,在文本渲染任务媲美GPT - 4o和20B + 开源模型。它架构优化、数据工程精细、训练范式独特,实测数据表现佳,显存占用低、推理快。

AIGC开放社区
算法论文7

人大-清华-腾讯发布:音频 - 视觉多模态任务统一框架

人大、清华和腾讯合作发布Crab论文,目标是实现多模态场景理解任务的高效一统。它针对音频 - 视觉理解模型难点提出解决方案,构建数据集、设计LoRA结构、统一架构,训练分预训练和指令调整两阶段。

CourseAI
产品应用7

Deep Search 如何理解业务仓库代码?

文章系统介绍Deep Search和Deep Research概念、与传统RAG区别、主流商业产品与开源方案、在代码领域应用及未来规划。提出Deep Search方案,构建独特代码理解与检索架构,还计划研发专用代码搜索Agent。

阿里云开发者
开源动态8

自定义轨迹驱动AI视频生成,ATI无需训练适配多种生成模型

字节提出视频生成运动控制统一框架ATI,通过轻量级运动注入器将用户定义轨迹投影至预训练图像 - 视频生成模型潜在空间,实现协调控制。用户指定关键点及路径控制运动,无需重新训练,适配不同架构

带你学AI
开源动态8

Obsidian 重度用户狂喜!13000+ Star 的 AI 编程助手直接嵌入知识库!

Obsidian 重度用户常为海量笔记整理发愁。Claudian 可将 AI 编程助手嵌入 Obsidian 知识库,支持多种 AI 工具,有文件读写、搜索等功能,还具备行内编辑、@提及引用等亮点,安装也很方便。

开源星探
开源动态8

MiniMax M2.5:230B参数仅激活10B,开源模型首次逼近Claude Sonnet,成本仅十分之一

MiniMax推出新一代开源模型M2.5,官方称其为‘为现实世界生产力设计的开源前沿模型’。性能逼近Claude Opus 4.6,采用混合专家架构,成本低。已在内部大规模部署,定位为‘AI员工’。

AI工程化