端到端学习」共找到 3464 篇相关文章

产品应用7

ElevenLabs 发布“视频音乐”:AI 读懂视频内容,为其创作氛围匹配的 BGM。

ElevenLabs推出“视频音乐”功能,其“Eleven Music”模型能分析视频上下文、情绪和风格,一键生成匹配的定制背景音乐,还能添加画外音和音效,为创作者提供音视频解决方案。

AI进修生
开源动态8

AI太难学?清华开源一批「学习虾」,免费的AI私教团来了

清华大学开源全球首个多智能体生成式学习AI技术框架OpenMAIC,它能将技术文档转化为零门槛学习课堂,还可解锁多种学习解法。其前身MAIC是重要学习平台,OpenMAIC功能强大,应用场景广泛。

CourseAI
产品应用8

小鹏加速冲向L4终局:对VLA架构「动刀」成关键一环

在辅助驾驶领域,的VLA方法虽有效果,但面临中间层语言难以准确表达物理世界细节的问题。小鹏汽车去掉“语言转译”环节,推出第二代VLA,有跨代级驾驶体验,背后是底层技术架构重构。

机器之心
算法论文8

机器人看视频学操作!伯克利首次打通互联网视频灵巧手真机部署链路

UC Berkeley团队提出流程,跑通从网络视频生成真实灵巧手实机执行轨迹链路。解决了单目RGB视频手-物交互重建、带噪声参考轨迹动作重定向及遥操作规模化难题。还给出数据筛选要点。

新智元
推荐文章7

将思维链(CoT)引入具身世界,哪种路径能真正打通机器人「知行合一」?

文章围绕将思维链(CoT)引入具身智能领域展开。介绍CoT从语言层面成为机器人行为核心认知机制的转变,分析分层架构与模型两种技术路径,还阐述自变量机器人统一架构的优势和能力。

AI科技评论
新闻资讯7

00后投身具身智能创业,剑指机器人界「Model 3」!已推出21个自由度灵巧手

具身智能创业公司灵初智能推出自研灵巧手,每只手21个自由度,操作能力强。其目标是将机器人整机价格打17000美元,走‘Model 3式的产业破局之路’,还提出分层算法解决训练难题。

量子位
新闻资讯8

马斯克「世界模拟器」首曝,1天蒸馏人类500年驾驶经验!擎天柱同脑进化

特斯拉官宣「世界模拟器」,可模拟、合成自动驾驶的「孪生世界」,生成不同视角和长尾场景。它基于神经网络,有学习人类价值观等优势。还能用海量数据解决难题,输出可解释中间结果,为自动驾驶和擎天柱训练服务。

新智元
产品应用8

kimi 的RL end2end ON LLM

文章分享Kimi Researcher背后技术思考,采用强化学习打造大模型Agent。对比传统方法,凸显其灵活通用、能力上限高、可扩展优势。还展示其在考试榜单成绩提升及智能“涌现”,介绍多应用场景。

Agent的潜意识
算法论文7

逆强化学习全新视角的大模型对齐技术

文章从逆强化学习(IRL)视角回顾LLM对齐进展。先介绍强化学习基础及挑战,将LLM生成过程化为MDP,探讨无奖励函数的MDP,说明需神经奖励模型,还阐述通过奖励建模实现IRL及多种优化方法。

PaperAgent
产品应用8

TRAE SOLO 移动发布!超级 Agent 终于走出了桌面

TRAE SOLO 移动正式上线,同时 Windows 版本也同步发布,实现手机、PC、Web 三全量开放且无需邀请码。它能完成多种任务,三任务信息实时全量同步,设备配对简单,在生产力场景实测效果出色。

特工宇宙