「非配对数据」共找到 3047 篇相关文章
12秒生成1万token!谷歌推出文本「扩散模型」Gemini Diffusion,研究员:演示都得降速看
谷歌将图像生成常用的“扩散技术”引入语言模型,推出Gemini Diffusion,12秒能生成1万tokens,速度比Gemini 2.0 Flash - Lite更快。它通过逐步优化噪声学习生成输出,目前是实验性演示,可申请体验。
英伟达让机器人「做梦学习」,靠梦境实现真·从0泛化
英伟达推出DreamGen项目,让机器人‘做梦学习’。它利用视频世界模型生成神经轨迹,仅少量现实视频就能让机器人学会新任务,实现从0泛化,还将助力GR00T - Dreams发展。
狂揽 9.9K star!比Selenium更好用的网页自动化利器,功能超强,太6了!
本文分享开源项目 SeleniumBase,它包装 Selenium 的 WebDriver API,功能强大。支持主流浏览器,内置测试框架,能搞定防爬检测。有智能等待等特色,安装简单,GitHub 有大量示例。
HTML正在成为 AI 办公的新载体?WorkBuddy 升级了一个关键能力
WorkBuddy升级“资料库”功能,普通用户不用写代码,用自然语言就能生成、编辑和发布HTML页面。用户能做书影音地图、播客可视化网站等,HTML可人机协同编辑,还能实现知识沉淀。
OpenAI和Anthropic费尽心机加密的思维链,竟然能被轻松提取?
围绕大模型蒸馏争议已久,此前外部团队难获闭源模型完整推理。8 月 10 日研究者公开方法,可让弱模型读取旗舰模型密文并输出推理,还发现公开智能体轨迹存在隐私泄露问题,不过未为蒸馏指控提供决定性证据。
陶大程技术博客首发:从像素复刻到行动控制,具身世界模型的底层逻辑探索|甲子光年
今年世界模型成AI热点,通用世界模型追求像素逼真,具身世界模型不同,其使命是支撑行动。文章拆解具身世界模型底层逻辑,分享开悟世界模型的技术设计与实践思考。
人工智能正在重写艺术现场:全球7个值得关注的案例盘点
MANA每周精选全球AI艺术案例,助读者理解创作、策展和文化产业的变化。文中介绍7个案例,如美国首座AI艺术博物馆、AI影像进入电影节等,还阐述各案例影响与启发。
TRAE SOLO移动端上线,手机也能干活了,随时随地Vibe Working
TRAE SOLO 移动端上线,实现手机、桌面、网页三端打通,全量开放。它让闪念能无缝接入工作流,还带来实时语音交互、飞书 CLI 接入、定时任务等功能,推动智能体走向新阶段。
李飞飞做AI游戏,拿了4个亿
李飞飞联创的AI游戏公司Astrocade获5600万美元A+B轮融资。该平台让用户用自然语言描述就能生成游戏,上线8个月有2000万用户、月1.4亿次游玩。其用专门AI模型降低创作门槛,未来发展待察。
大型挂机现场:马斯克的55万英伟达GPU,利用率才11%
《The Information》报道,马斯克旗下xAI有55万英伟达GPU,利用率仅11%。原因包括大规模部署协调难、数据传输瓶颈和训练间歇性。这是行业普遍问题,xAI着手解决,设定50%利用率目标。