语出惊人」共找到 1146 篇相关文章

产品应用7

第一个用物理做计算原的大规模生成模型Un-0来了,或将AI能耗降低1000倍?

Unconventional AI 发布首个以物理为计算原的大规模生成模型 Un-0,由‘模拟耦合振子系统’驱动。其目标是降低 AI 能耗,在 ImageNet 64×64 上 FID 达 6.74,质量接近部分主流传统图像生成方法刚发布时水平。

机器之心
开源动态8

SD又回来了!一秒图,手机就能玩:SD3.5-Flash让专业AI绘画进入“闪电”时代

Stability AI联合萨里大学SketchX实验室推SD3.5-Flash模型,能在普通电脑甚至手机上快速生成专业级高分辨率图片。它将推理步骤压缩、显存要求降低、图时间大幅缩短,画质也没明显缩水,还在性能上反超SD3.5M。

AIGC开放社区
新闻资讯7

“通用大模型微调成为行业模型是伪命题”?医疗 AI 深度重构,传神联创始人何恩培:孪生智能体能砍 70% 线下复诊工作

本文为《2025年度盘点与趋势洞察》系列内容,传神联创始人何恩培认为通用大模型微调成行业模型是伪命题。他表示孪生智能体能砍70%线下复诊工作,还分享了医疗AI发展、中医和西医落地方向及突破方向等见解。

AI前线
新闻资讯7

“通用大模型微调成为行业模型是伪命题”?医疗AI深度重构,传神联创始人何恩培:孪生智能体能砍70%线下复诊工作

本文为《2025 年度盘点与趋势洞察》系列访谈,传神联创始人何恩培分享医疗 AI 发展看法。他认为通用大模型微调成行业模型是伪命题,介绍了传神素问中医大模型应用,还对比中西医 AI 化差异,探讨未来发展场景与挑战。

InfoQ
开源动态8

5B参数+4060Ti,10秒图,全流程开源可复现!补齐统一多模态生成编辑的开源版图,让高质量图像生成真正变得更轻量、更普及

近日,多机构联合发布统一多模态生成编辑模型DeepGen 1.0,仅5B参数,集成五大能力,4060ti 16G上10秒图,多项指标超大4倍工业级模型。团队开源全流程代码与数据,可从零复现。

量子位
新闻资讯7

谷歌Gemini 3.0「全家桶」年度压轴,前端不再需要人类!下周王者降临

网友爆料谷歌下一代旗舰模型Gemini 3.0将于10月22日发布。不少开发者拿到内测资格并放demo,显示其在前端开发表现惊人,能一键直网页、游戏等,还能原创音乐,或对前端和设计产生较大影响。

新智元
产品应用8

昨天夸国产大模型争气,今天Vidu Q3就霸榜了

国产视频大模型Vidu Q3在国际权威AI基准测试机构Artificial Analysis的最新榜单里,于Video Arena冲到全球第二、国产第一。它是全球首个支持16秒音视频直模型,声画同、高清直,还有镜头控制、多言文字渲染等优势。

MacTalk
推荐文章7

AGI时代最稳的饭碗是什么?3Blue1Brown创始人:技术会淘汰,但信任不会

科普视频博主 Grant Sanderson 在播客中指,AI 因缺乏肉身和生理模仿机制,写不触动人类灵魂的文章,即便证黎曼猜想,若证明冗长,对人类也无意义。他还探讨了 AI 在数学领域的进展、局限,以及人类教师和科普作者在后 AI 时代的价值。

AI科技大本营
算法论文8

多模态推理新范式:上海AI Lab新作证明“画”答案比“说”答案更靠谱

上海人工智能实验室等联合提DiffThinker模型,利用扩散模型构建全新视觉推理范式。它在视觉中心任务上表现优异,准确率碾压GPT - 5等模型,还能与MLLM协同推理实现1 + 1 > 2的效果。

深度学习自然语言处理
开源动态8

从多模态大模型中「拆」音频向量模型

Google 发布原生多模态向量模型 Gemini Embedding 2,推动 Omni Embedding 发展。Jina AI 团队分享从多模态大模型中「拆」音频向量模型的经验,介绍架构、训练数据,对比四种做法,还提及评测、应用场景及结论。

Jina AI