能碳产业大模型」共找到 10382 篇相关文章

产品应用8

AI 模特时代到来:字节x清华推出商用级视频换装模型DreamVVT,保真度显著领先SOTA

字节跳动智创作团队联合清华推出视频换装模型DreamVVT,基于Diffusion Transformer构建,用两阶段设计解决复杂场景痛点,支持多种输入,在保真度和时序稳定性上领先SOTA。

机器之心
新闻资讯8

Nano Banana 拉爆谷歌营收创纪录,劈柴哥开心坏了!幕后团队曝内部“绝对优先事项清单”

谷歌CEO宣布单季营收破1000亿美元,Gemini月活达6.5亿。Nano Banana模型功不可没,其下载量飙升带动Gemini。幕后团队透露其诞生过程,还探讨AI对艺术创作影响、模型发展方向及未来迭代重点等。

AI前线
算法论文8

国产多模态Agent拿下医学分割SOTA!不用改模型、不加token | 浙大&上海AI Lab

现有医学多模态大模型在分割生物医学图像时存在瓶颈,浙大蔡钰祥教授、上海AI Lab江彦开等人提出IBISAgent框架,将分割定义为多步视觉决策过程,实验显示其在多数据集上大幅领先对比方法。

量子位
新闻资讯8

刚刚,OpenAI拿下IOI金牌,仅次于前五名人类选手!参赛推理模型才夺得IMO金牌

2025年国际信息学奥林匹克(IOI)中,OpenAI推理模型获金牌,在AI参赛者中排第一,得分仅落后5位人类选手。其未专门训练,成绩较去年大幅提升。此前它在IMO也获金牌级别成绩。

机器之心
新闻资讯8

商汤分拆了一家AI医疗公司,半年融资10亿,剑指“医疗世界模型

商汤分拆AI医疗公司,半年融资10亿。其以自研“大医®”为核心构建医疗世界模型,形成闭环。推出智慧医院方案,临床、决策、患者端等多方面落地成果丰富,还布局海外市场,未来想让AI从文本到模拟决策。

量子位
产品应用8

vivo发布端侧多模态模型,只有3B可理解GUI界面,20项评测表现亮眼

vivo AI Lab发布端侧多模态模型BlueLM - 2.5 - 3B,融合文本与图文力,支持长短思考模式切换。它在20余项评测中表现出色,参数量小,训练和推理成本低,有精巧结构、高效策略,还有高质量数据和高性平台支撑。

量子位
算法论文7

生成式推理再排序,可会是LLM4RecSys的新突破口吗?

Meta AI研究者尝试把推理模型引入推荐系统再排序阶段。论文通过监督微调等赋予模型推理力,超LLM4Recsys标杆。中期内化物品语意ID,生成推理路径,推理赋再排序,披露重排序提升空间。

机器之心
新闻资讯7

中国大模型如何破圈?开源不太“独角戏”,也不是“上传 GitHub 就完事儿”

InfoQ 专访 Linux 基金会 Mark Collier,他分享对 AI 时代开源看法。指出开源是协作哲学,AI 开源与传统不同,倡导开放数据,认为商业限制不利生态,还谈及 Agent 与中国大模型开源等问题。

InfoQ
产品应用7

Claude Code 更长更快!Agent自己管项目了!从 Todo 升级到 Task

上周Claude Code团队更新任务清单系统,从「记事本」升级为「项目管理系统」。因模型力增强,需求变复杂,原TodoWrite无法满足,新Task系统解决了任务依赖协调问题,支持复杂项目。

AI产品自由
产品应用8

谷歌机器人大脑又进化了。成功率飙3倍,还看表干活、保护自己

Google DeepMind发布机器人大脑Gemini Robotics ER 1.6模型,提升机器人空间感知、多视角解析与仪表读取准度,具精准指认、读表力,还提高操作安全性与合规度,开发者可通过Gemini API等使用。

AIGC开放社区