「高质量输入」共找到 2440 篇相关文章
谁在为人形机器人铺「全开源生态」?
2026 年人形机器人硬件发展快,但行业生态基本未变、研发成本高。乐享科技旗下元点机器人联合 CMU 发表两篇论文,又发布开发者全开源生态 OpenBridge,将“从闭门造车到开源共创”路径摆在台面。
阿里「快乐小马」来了,首批网友已玩疯!720P低至0.44元/秒
今天,阿里HappyHorse - 1.0开启灰度测试。它有电影级叙事质感,指令遵循能力强,能驾驭多种风格,还可一句话改视频。性价比高,720P低至0.44元/秒,让AI视频从‘玩具’变‘工具’。
今天,Anthropic偷偷移除了Pro用户的Claude Code访问权
Anthropic一度将Claude Code从Pro套餐移除,引发开发者不满,数小时后官网回滚,负责人称是小范围测试。Claude Code因高消耗或调整收费,Anthropic正修正订阅模型,这或改变开发者工具格局。
右兔短视频去水印工具正式上线!
右兔去水印工具,一键解析全网短视频,无需广告,免费下载,支持高清原画质。
【深度长文】从“会聊天”到“能干活”:OpenClaw架构深度拆解与价值挖掘
文章深度拆解 OpenClaw 架构,指出传统 SaaS 走向末路,OpenAI Operator 有局限。OpenClaw 以本地原生机制崛起,具备诸多优势,还介绍了其安全方案及五大高价值商业场景,鼓励关注学习。
直播预约 | 迈向用于演绎推理的诚实语言模型
本次讲座聚焦迈向用于演绎推理的诚实语言模型。当前语言模型难诚实推理,输入不足会产生无根据答案。为此制定多步骤任务,提出强化学习方法ACNCHOR,稳定学习过程、提高推理性能。
少量视角也能得到完整3D几何,即插即用的语义增强重建插件来了
现有神经隐式路线在样本稀疏时有跨视角对应不稳等问题。上海交通大学等团队提出SERES,将跨视角语义一致性作先验注入模型,以低成本解决歧义问题,在多场景提升重建质量。
ICML 2025 Spotlight|南洋理工陶大程教授团队等提出基于RAG的高分辨率图像感知框架,准确率提高20%
南洋理工陶大程教授团队等合作,为解决多模态大语言模型处理高分辨率图像问题,探索 RAG 应用可行性,提出 Retrieval-Augmented Perception (RAP) 框架,在多任务上提升性能,已被 ICML 2025 接收。
GUI 精准定位新 SoTA:LASER 让模型从“看全图”走向“锁重点”
多模态大模型在高分辨率、元素密集的 GUI 场景易误判。苏州大学 OpenNLG 团队提出 LASER 方法,让模型学会主动推理,通过关键区域聚焦等提升定位精度,在基准测试中表现出色。
Lovart的开源平替产品,完全本地免费的AI设计Agent。
Lovart是热门AI设计Agent但使用成本高,现找到开源平替项目Jaaz。它接OpenAI绘图API,支持Comfyui等本地工具,能免费本地使用,功能丰富,还将推视频生成功能。