「美学表现」共找到 2253 篇相关文章
The Batch: 882 | Qwen3-Next 提速
阿里巴巴对开源权重模型 Qwen3 全新升级,发布 Qwen3 - Next - 80B - A3B 的 Instruct 和 Thinking 版本权重。其融合新研究成果,推理能耗低、速度快,还优化架构和训练方法提升效率与稳定性。
突破后训练瓶颈?Meta超级智能实验室又一力作:CaT解决RL监督难题
AI后训练依赖监督微调或程序化检查器,但很多有价值任务缺这两种资源。Meta超级智能实验室等机构研究者提出CaT方法,把推理时额外计算当教师信号,为大模型提供监督,实验显示效果显著。
特斯拉下一代金色Optimus原型现身?一双「假手」成为最大槽点
Salesforce CEO发布与金色Optimus对话视频,盛赞其开启物理智能体革命。不过,其高昂价格、“假手”设计引争议。对比Figure机器人精准装碗视频,特斯拉Optimus表现不尽如人意,是否遇麻烦引人猜测。
其实,扩散语言模型在最终解码之前很久,就已确定最终答案
随着扩散语言模型(DLM)发展,它成自回归(AR)模型有力替代。但实际推理慢于 AR 模型。研究者发现早期答案收敛现象,提出 Prophet 策略,实验显示其能在保持高质量生成时显著加速推理。
Chain-of-Agents: OPPO推出通用智能体模型新范式,多榜单SOTA,模型代码数据全开源
OPPO个性化AI实验室团队推出智能体推理范式CoA及模型AFM,解决传统多智能体系统通信效率低等问题。AFM在近20项测试中刷新记录,降低推理成本,还介绍了架构、数据构建等,也指出待探索方向。
港大联手月之暗面等开源OpenCUA:人人可造专属电脑智能体
香港大学 XLANG Lab 和月之暗面等多家机构提出用于构建和扩展 CUA 的完全开源框架 OpenCUA,含注释工具、大规模数据集等,还构建旗舰模型 OpenCUA - 32B,公开代码、数据和模型。
20000 GPU·h砸出 106 个SOTA模型架构:AI 科研进入“自我加速”时代
模型架构发现领域迎来突破,ASI - ARCH超级智能体无需人类预设搜索空间,完成科研闭环。经20000 GPU·h、1773次实验,发现106个超越人类SOTA的线性注意力架构,且已开源。
物理学「AlphaGo时刻」?40年未竟之事被AI一举攻破,顶尖物理学家集体傻眼
AI主导设计的物理实验方案让顶尖科学家看不懂却成功了,它设计新颖光学元件布局使LIGO灵敏度提升10% - 15%。此外,AI还在量子纠缠实验设计、解析实验结果等方面展现强大能力,辅助物理学发现的新时代或已到来。
不,AI 并没有让工程师的生产力提高 10 倍
作者 Colton Voege 分享自身经历,指出 AI 未让工程师生产力提升 10 倍。试用多种 AI 编程工具后,发现其有局限。从算笔账、分析 10 倍工程师等方面论证观点,还剖析鼓吹 AI 者的情况。
效果非常不错!阿里昨开源图形海报生成模型Qwen-Image
阿里昨日开源多模态图像基础模型Qwen-Image,基于20B参数MMDiT架构,在复杂文本渲染和精确图像编辑方面有重大突破,支持多风格图像生成、智能图像编辑等,还介绍了使用、部署等方法。