可扩展监督」共找到 4362 篇相关文章

开源动态7

能自动把PDF转换为填写表单的开源工具,实用落地。

CommonForms是能自动将PDF转换为填写表单的开源工具,通过检测文本框等自动添加交互字段。它基于YOLO11做目标检测,支持CLI和API使用,有多种功能特点,能高效处理转换。

开源AI项目落地
产品应用7

视频进入编辑时代:藏师傅教你视频版 Banana 灵 O1

灵发布大一统视频、图像生成和编辑工具 O1,支持在一个界面完成视频图片编辑生成。此次更新统一多模态视频大模型,支持多模态输入,有诸多新特性,还支持自由选择视频生成时长和风格转换等。

歸藏的AI工具箱
产品应用7

一个销售数据分析机器人的诞生:看 Dify 如何在 DMS 助力下实现自动化闭环

Dify是低代码AI应用开发平台,但在企业级落地有代码执行和自动化调度瓶颈。本文介绍用“Dify + DMS Notebook + DMS Airflow”架构,以销售数据分析机器人为例,展示构建调度、扩展运维Agent系统的方法。

阿里云开发者
产品应用8

灵2.5 Turbo太凶残:30%成本暴降+效果飞跃,生成体操动作去参赛

快手推出灵2.5 Turbo视频生成模型,在力量感、滞空感和物理感知上进步明显。官方称其在文本响应、动态效果等维度效果提升,高品质模式成本降30%。不过,它在物理认知方面仍有欠缺。

量子位
产品应用8

创业一年后,李飞飞推出首款商用世界模型 Marble,任意模态都生成 3D 世界

李飞飞创业公司 World Labs 推出商用世界模型 Marble,支持多模态输入,生成的 3D 世界更丰富细致。李飞飞认为空间智能是 AI 下一个前沿,当前 AI 在这方面能力不足,而 Marble 正推动其发展。

Founder Park
新闻资讯7

别再问什么工作被AI取代!Karpathy直指本质:你的工作「验证」吗?

前特斯拉AI负责人Andrej Karpathy提出,软件1.0自动化能指定的任务,软件2.0自动化能验证的任务。判断任务能否被AI接管,关键看是否满足重置、高效试错、自动奖励三条准则。

新智元
开源动态8

小扎又开源了:7B实现自监督学习SOTA

Meta发布全新开源视觉模型DINOv3,首次证明自监督学习模型能在广泛任务中超越弱监督学习模型。它用无标注方法,扩展数据和模型规模,支持标注稀缺场景,在多任务实现SOTA。

量子位
算法论文8

SIGIR 2025 | 解决扩展和迁移难题,华为新加坡提出InstructRAG,提升高达19%

大语言模型任务规划面临扩展性和迁移性挑战,华为新加坡团队提出 InstructRAG 方案,通过多智能体协同架构实现指令图扩展与少样本任务迁移,在多数据集测试中性能提升高达 19.2%。

机器之心
算法论文8

ECCV 2026 | 一段视频,重建一个仿真的动态世界

机器人走出实验室后,训练数据需覆盖真实世界情况。OVOW由多团队完成,被ECCV 2026接收。它从单目视频出发,输出编辑、碰撞的实例级Mesh,串联视觉基础模型完成流水线工作,能用于物理仿真。

机器之心
推荐文章8

改写纳米光学底层逻辑!MIT学者搭建通用重构光子平台

MIT助理教授唐皓凝构建相对运动的双层纳米光子系统,将机械运动变为定量科学变量。2024年,她和合作者集成光谱仪和偏振仪功能。她想发展编程光子架构,还把AI作工具。

DeepTech深科技