「3D AI」共找到 10827 篇相关文章
在 Sora 诞生之前,胡修涵做了两年多的「二次元版 Sora」
Sora发布后迅速获数百万用户,全球刷屏。国内创业公司捏Ta在其诞生前两年就开始做类似产品,专注二次元和OC人群。捏Ta创始人胡修涵分享对Sora的看法,认为它是新形态产品,还在探索需求。同时谈及捏Ta发展阶段、特色功能及社区运营理念等。
汇丰科技25年丨植根中国,服务全球,加速金融创新和数字化进程
汇丰科技中国从 16 人团队成长为全球科技中心,率先用区块链、AI 等技术为全球跨境交易提速。25 年来扎根中国,在技术、人才等方面成果显著,未来将持续提升创新与服务能力。
「看」能否取代「读」,为何DeepSeek-OCR 爆火的重点不在性能?
DeepSeek近期开源的DeepSeek - OCR在AI社区引发热议。它提出‘上下文光学压缩’理念,以视觉方式压缩文本。社区关注重点在其研究思路对NTP范式的影响,有望解决长上下文经济性难题等。
AGI前夜重磅:RL突破模型「认知上限」,真·学习发生了!
AI研究圈争论RL能否赋予模型超越基础模型的推理能力。UC Berkeley等团队提出DELTA框架,观察到“RL grokking”现象,还设计新任务验证,提出两阶段奖励调度,总结两种模式等,为争论带来新依据。
OpenAI入股AMD,股价暴涨35%!奥特曼左手黄仁勋,右手苏姿丰,通吃全球算力
OpenAI宣布与AMD达成战略合作,将部署6GW的AMD Instinct MI450 GPU集群,可认购最多1.6亿股AMD普通股,持股比例或达10%。消息公布后,AMD盘前股价飙升35%。此前OpenAI也官宣与英伟达合作。
The Batch: 883 | 美国两个州禁止人工智能驱动的心理健康治疗
美国伊利诺伊州成继内华达州后,第二个禁止用人工智能进行心理治疗的州。该法案限制聊天机器人独立治疗及其他AI使用方式,旨在保护患者和人类治疗师,但也引发对全面禁止利弊的讨论。
Apple发布新SOTA Manzano:混合Tokenizer破解多模态统一难题,理解与生成双翼齐飞
多模态AI前景广,但现有模型在理解和生成任务上存在性能冲突。苹果提出Manzano模型,用混合视觉标记器降低任务冲突,结构简单可扩展,在多基准测试达SoTA水平,还展示图像编辑潜力。
Qwen-Image-Edit 更新:多图编辑支持,单图一致性增强
阿里8月发布的Qwen-Image-Edit迎来月迭代版本Qwen-Image-Edit-2509,可在https://chat.qwen.ai/使用。更新支持多图编辑,有多种玩法,还提升单图一致性,在人物、商品、文字编辑上表现显著。
谷歌开源新Deep Research范式,教Agent学会真正的思考。
周末谷歌发博客讲Deep Research,它重新定义一些Agent常见范式。现在多数Agent模式缺全局观,谷歌让AI先打草稿再迭代修正。新框架含技巧,在多任务上超OpenAI,已可试用。
对谈 Macaron 创始人陈锴杰:RL + Memory 让 Agent 成为用户专属的“哆啦 A 梦”|Best Minds
本文访谈 Macaron 创始人陈锴杰,探讨 RL+Memory 让 Agent 发展及 Macaron 产品。他强调 RL 在 Agent 开发重要性,介绍 Macaron 定位、特点、训练方式,还谈及社区设想、RL 应用及产品发展方向等。