能碳产业大模型」共找到 10345 篇相关文章

算法论文8

训练数据爆减至1/1200!清华&生数发布国产视频具身基座模型,高效泛化复杂物理操作达SOTA水平

清华大学与生数科技联合研发Vidar模型,首次让通用视频大模型长出‘手脚’,实现从虚拟到真实世界物理执行的跨越。它降低数据门槛,突破跨本体泛化困境,为服务机器人应用奠定基础。

量子位
算法论文8

监督学习也从错误中学习反思?!清华英伟达联合提出隐式负向策略爆炸提升数学

清华大学与英伟达、斯坦福联合提出监督学习方案NFT,在RFT算法基础上构造“隐式负向模型”利用负向数据训练。该策略弥合监督与强化学习差距,其损失函数梯度和GRPO在On - Policy条件下等价。

量子位
算法论文8

ICCV 2025 | 跨越视觉与语言边界,打开人机交互感知的新篇章:北大团队提出INP-CC模型重塑开放词汇HOI检测

北大团队提出 INP - CC 模型重塑开放词汇 HOI 检测。它提出交互感知提示生成和概念校准两项创新,结合输入图片特性构造提示集合,引入‘困难负样本采样’策略,在两大数据集上表现超 SOTA。

机器之心
算法论文8

仅看视频就copy人类动作,宇树G1分分钟掌握100+,UC伯克利提出机器人训练新方式

UC伯克利团队研发出名为VideoMimic的新系统,将视频动作迁移到真实机器人。它已让宇树G1模仿100多段人类动作,还适应各种地形。其工作流程含视频转仿真、仿真训练策略、策略迁移到实体机器人。

量子位
新闻资讯8

“大模型第一股”打响上市前哨战!智谱GLM-4.7 刷新开源编程SOTA,修复代码、终端操作表现超Claude 4.5

冲刺大模型第一股的智谱推出开源大模型GLM - 4.7,主打编程与代理式任务提升。它在多项基准测试中表现出色,UI质量飞跃,还采用新推理机制。智谱上市在即,但亏损扩张快,研发投入大。

AI前线
7

这个开源工具让AI理解你正在操作的任何界面,俩学生辍学开发的产品,功超多。

Everywhere是两个学生辍学开发的开源交互式AI助手,感知屏幕内容,在任意界面使用。它功多、细节优,支持多场景,集成多种AI模型,使用简单,还提供个性化体验。

开源AI项目落地
开源动态8

一句话搞定后端?揭秘被 52.1k 开发者选择的 PocketBase:真让你 0 运维快速上线产品吗?

PocketBase是“把后端打包成一个文件”的开源项目,既可以作为独立的轻量后端服务直接运行,也作为Go库嵌入到应用中。它解决团队做MVP等遇到的痛点,有诸多核心功和技术优势。

小华同学ai
8

小米双模型正式开源!MiMo-V2.5-Pro无中断肝出“macOS”:54个应用全开、浏览器真冲浪

小米MiMo-V2.5系列模型正式开源,权重全量开放。该系列含四大模型,综合实力对标国际顶尖水准。MiMo-V2.5 Pro力出色,如4小时无中断完成“macOS”系统,且Token效率高省成本。小米还推出开发者扶持计划。

量子位
产品应用8

把短视频做成流水线的AI剪辑神器

Pixelle-Video是一款AI剪辑神器,输入主题就自动完成视频创作,零门槛。它采用模块化设计,流程清晰,各环节可灵活定制。支持多种AI模型、TTS方案,有丰富功亮点。

GitHubStore
开源动态7

3.3k星星爆火!Claude Design开源升级版,中文本地化,支持DeepSeek V4

Anthropic发布的Claude Design生成UI、人机协作,但国内无法使用且不用自己的API。Open-codesign是其开源本地化平替方案,支持多模型,功丰富,保密性好。

开源AI项目落地