训练可用度」共找到 5622 篇相关文章

算法论文8

ICLR 2026 Oral | Revela:用语言建模重新定义稠密检索器训练

在检索增强生成系统中,稠密检索器是核心组件,但传统训练方法有局限。德国达姆施塔特工业大学蔡丰宇团队提出Revela,将检索器训练目标统一到语言建模框架,优势明显,实验效果佳。

机器之心
新闻资讯8

英伟达:RLP 让 AI 在预训练时就学会思考

英伟达研究团队发布 RLP 技术,与传统大语言模型训练不同,它在预训练阶段就让模型学会'先想后说'。通过奖励机制自我监督,实验效果惊人,性能提升显著,不挑数据,打破了大模型训练范式。

AI工程化
推荐文章8

改写纳米光学底层逻辑!MIT学者搭建通用重构光子平台

MIT助理教授唐皓凝构建相对运动的双层纳米光子系统,将机械运动变为定量科学变量。2024年,她和合作者集成光谱仪和偏振仪功能。她想发展编程光子架构,还把AI作工具。

DeepTech深科技
新闻资讯7

为了训练AI,Meta强制监控了员工的鼠标和键盘

近日,Meta宣布在美国员工电脑装追踪软件,记录鼠标、键盘操作及截取屏幕内容,用于训练AI。这引发员工愤怒,Meta CTO称员工无法退出。Meta AI投入大,此举或因缺训练数据,但也被质疑是在训练替代者。

DeepTech深科技
推荐文章7

对话斯坦福终身教授徐升:我找到了穿戴的“宝藏”

本文对话斯坦福终身教授徐升,他研究方向从基础材料转向柔性穿戴超声。其团队成果包括穿戴心脏超声成像贴片、连续胎儿血流监测贴片等。他认为穿戴电子缺‘AlphaGo时刻’,还分享学术与创业经验。

DeepTech深科技
开源动态8

蚂蚁灵波开源LingBot-VLA后训练代码!150条示教数据即适配新机器人

蚂蚁集团旗下灵波科技全面开源具身基座模型LingBot-VLA的真机后训练工具链,覆盖四个关键环节。模型基于2万小时真实机器人数据预训练,仅需150条演示数据就能迁移任务,训练效率更高。代码库已在GitHub开源。

量子位
推荐文章7

AI 原生应用全栈观测实践:以 DeepSeek 对话机器人为例

本文以 DeepSeek 对话机器人为例,介绍 AI 原生应用架构观测需求、挑战与方案实践。分析 AI 领域痛点,提出阿里云 AI 全栈观测架构,剖析大模型应用观测技术,分享实战案例,还给出未来规划。

InfoQ
产品应用7

吉卜力风「手游」爆火,灵+Midjourney生成的!教程已出,支持复刻

吉卜力风格“手游”在Reddit和推特爆火,它由AI制作,创作者用灵AI、Midjourney结合文字提示实现效果,公开教程支持复刻。还介绍了制作方法及提示词示例,灵AI发展势头也很猛。

量子位
新闻资讯8

专治智能体盲跑!微软发布AI Agent 5大观测性,打通任督二脉

今天凌晨微软官网发布AI Agent 5大观测性最佳实践,解决智能体盲跑等难题。介绍了智能体观测性概念和好处,展示5个应用案例,还阐述5大实践,如选模型、持续评估、集成CI/CD等。

AIGC开放社区
新闻资讯7

【独家】对话汤元科技任冬淳:物理AI的瓶颈,在于训练体系|甲子光年

对话汤元科技任冬淳,探讨物理AI瓶颈。他认为物理AI瓶颈在训练体系,要满足数据结构质量、训练验证闭环、数据规模效率三要求。汤元构建训练底座,为具身智能和智驾提供服务,具身智能是未来重心。

甲子光年