设计与代码」共找到 8201 篇相关文章

开源动态8

视觉Token注入CLIP语义,走向多模态理解生成新范式

腾讯ARC Lab等机构提出全新视觉分词器TokLIP,将低级视觉Token高级CLIP语义结合,支持端到端自回归训练,可接入LLM框架,降低计算数据门槛,在多模态任务中表现优异,代码已开源。

量子位
新闻资讯7

人形机器人设计正在向仿真器低头!40年机器人从业老兵发出警告

人形机器人行业现怪象,为让仿真系统和强化学习更顺,一些有机械优势的结构因‘仿真麻烦’被排除。40多年经验的Scott Walter质疑设计变得‘S.T.U.P.P.I.D.’,指出仿真应服务设计而非主宰。

机器之心
产品应用7

Alibaba力作:Ovis-U1 融合理解、生成编辑,解锁无限可能

OpenAI 2025 年推出的 GPT - 4o 结合图像语言能力,但引发视觉解码器设计及统一模型训练问题。Alibaba 力作 Ovis - U1 单一模型能完成理解、生成编辑任务,介绍了其架构、训练过程和应用。

CourseAI
产品应用7

数智赋能:建筑地产行业的转型突围未来筑造

建筑地产行业在全球经济中至关重要,当下数字化转型成关键。华为凭借对‘好产品’的理解及数字化实践,多家企业合作推动转型。数智化在设计、运营等端发挥作用,助力行业实现效率质量双飞跃。

机器之心
算法论文8

首次结合RLSFT各自优势,动态引导模型实现推理⾼效训练

新一代大型推理模型在复杂推理有进展,核心是ZERO - RL训练法。华为香港研究所小艺团队等合作推出GHPO算法框架,融合在线强化学习模仿学习,解决了RLVR方法局限,提升模型训练效果,代码数据开源。

机器之心
开源动态8

ICML 2025 Spotlight | 用傅里叶分解探讨图像对抗扰动,代码已开源

文章聚焦图像对抗净化,现有基于扩散模型策略在时域难解耦干净像素扰动,损害图像语义。作者从频域研究,用傅里叶分解,发现扰动倾向破坏高频谱,提出注入低频信息,效果显著,论文代码已开源。

机器之心
产品应用8

AI Code要变天了,Meta首个代码世界模型登场!

Meta FAIR推出32B参数的代码世界模型(CWM),旨在探索世界模型如何改变代码生成和推理,code和mode已开源。在SWE - bench验证中表现优,能更大规模或闭权重的LLM竞争,还介绍了训练、数据集等情况。

PaperAgent
产品应用8

GitNexus:GitHub一周暴涨6000星!这个"零服务器代码神器"让AI终于能看懂你的代码

GitNexus是零服务器代码智能引擎,能将GitHub仓库或ZIP文件转为交互式知识图谱,让AI看懂代码依赖。它有知识图谱构建等功能,支持多语言,适用于接手项目、代码审查等场景。

小华同学ai
产品应用8

Lovart第一时间上线Image 2:每个人真的可以瞬间拥有一个设计部了

Lovart上线Image 2,有去AI味的写实感、强大文字生成泛化推理能力,完爆Nano Banana 2。它结合独家工作流,带来设计体验飞升,还给出五个使用场景案例,并对比了Claude design的差异。

AI寒武纪
开源动态8

阿里重磅开源!Open Code Review:一周 5k star,为你的代码保驾护航

阿里开源 Open Code Review,它前身是内部 AI 代码评审助手,经大规模验证。该工具结合确定性工程 Agent,解决通用 Agent 评审代码的问题,在准确率、效率等方面表现出色,还介绍了使用方法和评估方式。

阿里云开发者