开源开发」共找到 4196 篇相关文章

开源动态8

效果非常不错!阿里昨开源图形海报生成模型Qwen-Image

阿里昨日开源多模态图像基础模型Qwen-Image,基于20B参数MMDiT架构,在复杂文本渲染和精确图像编辑方面有重大突破,支持多风格图像生成、智能图像编辑等,还介绍了使用、部署等方法。

GitHubStore
算法论文8

监督学习未死,一题训练五小时起飞!华人学者新方法20倍训练效率释放大模型推理能力

大模型推理能力研究中,RL训练资源成本高、不稳定,传统SFT低数据量易过拟合。加拿大滑铁卢大学华人团队提出One - Shot CFT方法,用一题多解多点评训练,仅需约5个GPU小时,效果好、稳定性强。

量子位
开源动态8

万亿参数狂欢!一文刷爆2025年七大顶流大模型架构

文章深入剖析2025年顶级开源模型的创新技术,介绍了DeepSeek V3/R1、Kimi 2、Qwen3等七大顶流大模型架构,揭示滑动窗口注意力、MoE和NoPE如何重塑效率与性能。

新智元
推荐文章7

硅基公司裁员二三事

作者回顾2017年入职硅基智能(当时叫南京必拓狮)的经历,讲述公司转型AI赛道的过程、产品开发情况,以及老板司马华鹏的想法和管理方式,还总结了创业应注意的教训。

Agent的潜意识
算法论文8

免剪辑直出!AI生成多角色同框对话视频,动态路由精准绑定音频

Bind-Your-Avatar基于扩散Transformer框架,通过细粒度嵌入路由将语音与角色绑定,实现精准音画同步,还引入数据集MTCC和基准测试,实验显示其在身份保真和音画同步上优于现有方法。

新智元
开源动态8

不靠Agent,4步修复真Bug!蚂蚁CGM登顶SWE-Bench开源

蚂蚁集团代码图模型 CGM 基于开源模型,不靠 Agent 架构,用 4 步轻量级流程完成仓库级代码修复,在 SWE - BenchLite 公开排行榜成绩亮眼,打破闭源垄断,还解决了 LLM + Agent 架构的一些问题。

机器之心
算法论文8

推理正确率下降65.5%!斯坦福、MIT等用「不等式」拷问AI逻辑极限

大语言模型在数学证明常现推理漏洞,斯坦福等高校团队提出IneqMath基准评估其严谨性。用不等式证明题切入,拆解为子任务,构建评测体系,用LLM - as - Judge审查。结果显示模型推理正确率低,存在结构性缺陷。

新智元
算法论文8

DPO与GRPO谁更胜一筹?港中文、北大等联合发布首个系统性对比研究

港中文、北大等团队首次全面对比DPO和GRPO算法在自回归图像生成中的应用,评估其在域内、域外性能,探究奖励模型及扩展策略的影响,为开发高效RL算法提供新思路。

机器之心
推荐文章7

被骂“在乱讲”的专家,这次可能说对了:传统数据仓库正在被 Agentic AI 吞噬

作者认为AI浪潮影响软件生态,Agentic AI时代下,传统数据仓库和复杂ETL链路将被重新设计甚至消失,其偏重结构与查询模式会被Agentic Data Stack架构强调语义与响应模式取代。

InfoQ
新闻资讯7

Builder.ai 破产背后:700 名工程师伪造 AI 是假,重复造轮子及财务造假是真

印度AI独角兽Builder.ai破产引发关注,此前有说法称其用700名工程师伪造AI。经与前员工沟通,这一说法不实。该公司搭建了AI工具Natasha,技术栈含Python、GPT等,但存在重复造轮子、财务欺诈等问题致破产。

Founder Park