视觉自监督学习」共找到 2005 篇相关文章

推荐文章8

顶尖模型离“科学家”还差得远?AI4S亟待迈向2.0时代

《Nature》研究指出,过度依赖现有深度学习模型或阻碍创新。上海 AI 实验室周伯文提出,应推动科学智能从 AI4S 迈向 AGI4S,还介绍“智者”SAGE 架构、“书生”模型及平台等探索成果,并邀同行共拓蓝图。

机器之心
开源动态7

长视频会议纪要、访谈节目精剪AI神器

WhisperVideo是用于长篇幅、多说话人视频的简洁演示系统,专为真实对话构建。它有SAM3视频分割、TalkNet主动说话人检测等功能,具备视觉关联说话人归属等特性,文中还介绍了安装、运行等内容。

GitHubStore
新闻资讯7

Node.js之父宣判“手写代码时代结束”!DHH明确反对“结束论”:大模型还差口气,手写更有竞争力

Node.js之父Ryan Dahl宣称人类写代码时代结束,而Ruby on Rails作者DHH反对,认为大模型还差口气,手写代码仍有竞争力。DHH分享AI使用体验,指出距AI带来明显优势的拐点还差一点,还探讨互联网和产品发布等问题。

InfoQ
开源动态8

让AI打游戏!能玩1000多款游戏,英伟达用4万小时视频训练出通用基础模型NitroGen

NVIDIA发布NitroGen模型,利用40000小时带按键显示的游戏视频,构建视觉-动作数据集,训练出能玩超1000款游戏的通用基础模型,在跨游戏泛化和微调任务中表现卓越,为具身智能发展提供新思路。

AIGC开放社区
算法论文8

为什么给机器人装上昂贵的触觉传感器,反而让它变笨了?

伊利诺伊大学香槟分校等多校合作研究发现,当前机器人学习主流的多传感器融合算法(特征拼接)在处理任务时存在局限,给机器人加触觉数据会使抓取成功率暴跌。研究提出组合策略解决问题,经测试效果显著。

机器之心
推荐文章8

Scaling 时代落幕:Ilya 眼中下一代 AI 的关键,不在模型,在人类

深度学习亲历者 Ilya Sutskever 认为单靠扩大模型规模推进 AI 的时代已结束,未来关键在于解决 AI 泛化难题。他指出当前模型评测与现实能力脱节,人类泛化能力强或源于进化,还探讨了价值函数等内容。

InfoQ
算法论文8

RL成本降幅超90%!Meta提出Agent训练新范式DreamGym

传统强化学习(RL)训练LLM Agent面临成本高、任务多样性不足等挑战。Meta团队提出DreamGym框架,以经验合成为核心,通过三大组件协同工作,在多种任务和模型上提升性能,为通用Agent训练开辟新路径。

深度学习自然语言处理
算法论文8

用两个简单模块实现分割理解双重SOTA!华科大白翔团队等推出多模态新框架

华中科技大学和金山办公团队联合提出语义增强特征提取器(SEFE)和交错局部视觉耦合(ILVC)模块,构建多模态大模型LIRA,解决现有模型分割不精确和理解有幻觉问题,在分割和理解任务上达SOTA。

量子位
算法论文8

腾讯提出“我思故我玩”Agent:LLM构建推理与规划世界模型

腾讯与武大联合发表论文提出 CEL 新型 Agent 架构,通过 LLM 驱动两阶段循环实现“思考式学习”。它能填补传统方法短板,在小游戏实验中表现出色,有可解释性等优势,但也有实验环境局限等问题。

深度学习自然语言处理
新闻资讯7

讲座分享 | 密歇根大学Karthik Duraisamy教授

密歇根大学Karthik Duraisamy教授将开展讲座,主题为数据驱动的湍流建模。会介绍过去十年嵌入学习模型增强的进展,强调简约与约束平衡,指出存在的陷阱及挑战,还提及让数据驱动封闭成为可靠组件的要点。

力学与人工智能