「架构发布」共找到 4562 篇相关文章

产品应用7

季度AI视频生成产品:多模态输入成标配,角逐一站式生成能力 | 量子位智库AI 100

Sora2下载量破百万引发AI视频生成热潮,谷歌推出Veo3.1再掀高潮。国外大厂将其卷至电影制作级创意,国内企业追求高质量、秒级生成并落地垂直场景。量子位智库发布的产品呈现多维度技术演进。

量子位
新闻资讯8

AI时代的传统车企转型:广汽的“双核”战略、组织裂变与自研之路|行知数字中国

本文讲述广汽集团数字化转型历程与规划。在新兴车企冲击下,广汽开启转型,从组织架构破冰到技术突破。转型中业务、组织、文化三重裂变,现进入 GDA 3.0 提出双核战略,还分享国企转型方法论及自研重要性。

InfoQ
产品应用7

独家丨专访 Tunee 产品负责人:国内首个对话式音乐创作 Agent,刚上线就好评如潮!

文章是对 Tunee 产品负责人的专访。Tunee 是国内首个对话式音乐创作 Agent,能记住用户偏好,自动完成母带与混音。团队坚持‘人人都能玩点音乐’,将在云栖大会发布新模型与吉他,还探讨了产品问题与未来规划。

特工宇宙
开源动态8

6.1B打平40B Dense模型,蚂蚁开源最新MoE模型Ling-flash-2.0

蚂蚁百灵大模型团队开源 MoE 大模型 Ling-flash-2.0,其以轻量级配置展现卓越性能,在推理速度、任务性能、部署成本间找到新平衡,为大模型‘参数膨胀’提供新路径,还在多领域应用表现出色。

机器之心
产品应用8

Nano-Banana 核心团队分享:文字渲染能力才是图像模型的关键指标

谷歌新发布的图像生成与编辑模型Gemini 2.5 Flash Image(Nano - Banana)热度超Grok视频生成。文章通过团队访谈,介绍其图像创作新方式、文字渲染代理指标、交错生成能力等,还对比了与Imagen差异,展望AI终极形态。

Founder Park
新闻资讯7

张一甲:2025中国科技投资痛点、趋势与展望 | 甲子光年

8月21日,甲子光年创始人张一甲发布《2025中国科技投资:痛点、趋势与展望》报告。指出当前一级市场科技投资止跌回暖但堵点仍存,还阐述了硬科技引领、AI投资逻辑变化等七大趋势,最后用“星空坐标系”评估投资赛道。

甲子光年
开源动态8

让强化学习快如闪电:FlashRL一条命令实现极速Rollout,已全部开源

清华AIR、字节联合团队曾发布DAPO实现大规模LLM强化学习。刘力源、姚峰团队发现DAPO-32B中rollout生成是瓶颈,推出FlashRL,应用INT8/FP8,用TIS解决不匹配问题,加速显著且不牺牲性能,一条命令即可使用。

机器之心
算法论文8

ICCV 2025 | 小红书AIGC团队提出图像和视频换脸新算法DynamicFace

小红书AIGC团队提出图像和视频换脸新算法DynamicFace。该算法创新性融合扩散模型与3D人脸先验,解耦身份与运动信息,设计双流注入架构和时序一致性模块,实验证明其在身份保真与运动还原上优势明显。

机器之心
新闻资讯7

奥特曼曝惊世预言:2035年GPT-8治愈癌症!人类将为算力爆发三战

新智元报道,GPT - 5发布引热议,奥特曼在访谈中金句不断。他预言2027年AI有重大科学突破,2035年GPT - 8或治愈癌症,2050年人类可能为AGI算力争夺爆发三战,还谈及AI发展瓶颈、对人类影响等。

新智元
开源动态8

刚刚,小红书开源了首个多模态大模型dots.vlm1,性能直追SOTA!

小红书人文智能实验室(hi lab)低调开源视觉语言模型dots.vlm1。该模型基于自研视觉编码器构建,在视觉理解和推理任务上接近SOTA水平,实测表现惊艳,还介绍了其技术架构、预训练数据布局等内容。

新智元