能碳产业大模型」共找到 10382 篇相关文章

开源动态8

ICCV25 Highlight|格灵深瞳RICE模型狂刷榜单,让AI「看懂」图片的每个细节

格灵深瞳公司灵感团队自研的视觉模型基座RICE(MVT v1.5)刷榜多项视觉任务,在ICCV25获Highlight荣誉。它延续MVT系列理念,提升图片内部视觉特征差异性,在多任务验证中表现优异。

机器之心
新闻资讯7

大神李沐回归B站「做了个实时数字人」,直言「水平吊打我自己」

大神李沐回归B站,展示用创业公司BosonAI的Higgs Avatar v1模型做的实时数字人,称其水平“吊打自己”。该模型带来接近真人的临场感,操作简单,有四大核心优势,已进入内测。

机器之心
产品应用7

一家智眼镜公司,为什么非要自研AI大模型系统?|甲子光年

眼镜要么不够智,要么不像眼镜,李未可科技CEO茹忆认为AI要成第一响应者。该公司推三款AI眼镜,搭载自研系统。其自研AI大模型系统,是为交付难复制AI体验闭环,解决通用API不足等问题。

甲子光年
算法论文8

刚刚,智元提出SOP,让VLA模型在真实世界实现可扩展的在线进化

智元具身研究中心提出SOP框架,可让VLA模型在真实世界实现可扩展的在线进化。它是颠覆性的机器人学习新范式,整合在线、分布式和多任务机制,构建闭环打破机器人认知时间边界。实验显示其性优越。

机器之心
产品应用8

开发者狂喜:Thinking Machines发布首款产品Tinker,后训练麻烦全给包了

OpenAI前CTO创办的Thinking Machines推出首款产品Tinker,这是用于微调语言模型的API,简化LLM后训练过程,支持前沿模型,使用LoRA技术降低成本,还发布开源库,多高校团队已试用。

机器之心
新闻资讯8

谷歌NotebookLM终于说中文了!这可是最火的大模型播客产品

NotebookLM正在变成谷歌AI路线里靠谱选手,现支持中文播报且将推移动App。它将音频源转化为类似播客的对话,有摘要等功,音频概览功受欢迎,底层是谷歌Gemini 2.5 Flash,实用性强,即将上线安卓和iOS版App 。

机器之心
推荐文章7

2025中国力学大会AI+分享 | 国防科技大学刘杰研究员:AI赋PDE全流程求解

在2025中国力学大会AI+分享中,国防科技大学刘杰研究员介绍AI赋PDE全流程求解。刘杰是研究员、博导,在并行算法等领域成果颇丰,主持多项项目,获多个奖项。

力学与人工智能
算法论文8

从像素空间走向数据流形:生成模型的对抗净化新范式 | TPAMI'26

深度神经网络虽应用广泛,但对对抗样本脆弱,制约可靠部署。本文介绍发表于TPAMI 2026的工作,提出基于一致性模型的对抗净化方法(CMAP),实验表明其在不同场景下鲁棒性强,为对抗防御提供新视角。

量子位
开源动态7

20刀月费秒变API!Hermes一行命令就用上Claude、ChatGPT订阅

两大开源Agent框架有硬核更新。Hermes Agent v0.14用一行命令把模型订阅变API,零成本驱动开发工具,还接入Grok。OpenClaw 5.18修复问题,适配Grok。20美元月费可喂饱工具链,打破生态闭环。

新智元
开源动态8

破解空间智数据稀缺难题,影石开源DiT架构全景生成模型,在线可玩

影石研究院团队推出基于DiT架构的全景图像生成模型DiT360,设计分层混合训练框架,结合透视与全景图像数据,提升真实感和几何一致性。它支持多任务,优于现有方法,为三维场景生成提供新思路。

量子位