开练」共找到 194 篇相关文章

开源动态8

LeCun团队源首个代码世界模型:能生成代码还能自测自修!传统编程模型一夜成古典

Meta FAIR推出全球首个代码世界模型CWM,它能生成代码、理解语义,还‘懂得’代码执行,能模拟运行过程。在多个代码与推理任务表现出色,源代码、训细节等,不过目前仅支持Python。

量子位
产品应用7

从衣服到饰品:OmniTry 实现珠宝、包袋等多类可穿戴物品的虚拟试穿

Kunbyte提出OmniTry,将VTON从服装扩展到任意可穿戴物品,采用无掩码设定。它经两阶段处理流程训,在12种常见物品类别评估中表现优,有扩展潜力,但也存在训数据类别限制等局限。

带你学AI
产品应用8

一个模型场景通吃!它石智航AWE3.7的泛化能力有点狠

长期以来,机器人系统多依赖专有模型,场景变化时需重新训。如今具身智能步入下半场,它石智航通用具身大模型AWE3.7用同一颗“具身大脑”贯通多场景,回应了通用泛化命题。

量子位
8

4秒卖出一只的爆款鸭,中国制造,宇树都来推销电机,复刻比买贵?

Hugging Face推出售价399美元的机器鸭Microduck,预售火爆,24小时销售额超260万美元。它源且可玩性高,社区二创丰富。其配置“五脏俱全”,由中韩中多方合作,软件栈也全套源,民间复刻成本超原版。

机器之心
产品应用7

豆包工作体验:Agent 正在成为工作的新入口

豆包发布“豆包工作”,定位为独立办公 Agent 工作台。体验良好,能项目、连办公应用。文章指出用户习惯迁移,Agent 成工作入口,还探讨了办公 Agent 的竞争点、权限问题、组织提效及人员角色转变等。

宝玉AI
算法论文8

国产多模态Agent拿下医学分割SOTA!不用改模型、不加token | 浙大&上海AI Lab

现有医学多模态大模型在分割生物医学图像时存在瓶颈,浙大蔡钰祥教授、上海AI Lab江彦等人提出IBISAgent框架,将分割定义为多步视觉决策过程,实验显示其在多数据集上大幅领先对比方法。

量子位
开源动态7

第六章 Coding优先编的是「过程与约束」,不是「参数」

本章以面包店类比训大模型,介绍 AutoResearch 自主实验框架。它将研究生助理工作循环交给 Agent,在固定时间用单一指标判断好坏。仓库获约 64.7K Stars,Karpathy 设计哲学为极简主义与固定约束。

CourseAI
开源动态8

Agent 自我改进的六条路

文章梳理了让 AI Agent 不重新训就能变强的六种机制,包括输出自审、持久记忆、进化搜索、对抗训、自我修改和编排自优化,介绍了各机制代表项目及成果,指出 AI 学习正从训溢出到部署阶段。

AGI Hunt
开源动态8

以小博大!Nanbeige4-3B重磅源:硬刚Qwen3,挑战小模型能力新高度

近年来大语言模型参数膨胀,成本升高,业界重注小语言模型。近日,Boss直聘南北阁大模型实验室发布仅30亿参数的Nanbeige4 - 3B,在多方面媲美甚至超越通义千问Qwen3系列模型,源印证小模型潜力。

AIGC开放社区
算法论文8

Vision-Zero:零数据VLM自我进化!陈怡然团队提出零监督训新范式

陈怡然团队提出零监督训新范式Vision-Zero,在多模态任务表现突出。它借鉴自博弈技术,设计自博弈框架,解决数据稀缺和知识天花板问题,还缓解跨能力负迁移,源代码与模型可供研究。

机器之心