「有监督微调」共找到 6465 篇相关文章

新闻资讯8

刚刚,OpenAI挖来黑客「祖师爷」!

OpenAI近期动作不断,菲尔兹奖得主、翁荔之后,黑客圈“祖师爷”Halvar Flake(真名Thomas Dullien)官宣入职。他是BinDiff之父,在谷歌有诸多成果,还参与开源项目用Claude修bug,此时加入或因GPT安全事件频发。

新智元
开源动态8

机器人需要一个「思考系统」:τ0-VLA让具身智能迈向长程任务时代

2026 WAIC落幕,具身智能成焦点。当前VLA模型在长程任务中有局限,上海创智学院和智元机器人联合发布τ(0)-VLA,提出分层架构和新推理机制,用大量真机数据训练,在长程任务表现出色。

机器之心
新闻资讯7

美国具身也没成熟!PI:中国公司何必总当“中国版XX”|RSS 2026

量子位参加RSS 2026后,发现国内外具身智能关注点有时差。会上听到不少与国内不同的判断,如北美具身智能公司未成熟,中国硬件领先。还探讨了世界模型与VLA、数据、全身智能及产业出海等问题。

量子位
开源动态8

大部分token根本不该重复计算,不止于KVCache

斯坦福研究显示,AI Agent每次调用62%内容重复,现有前缀缓存虽有优化但天花板低,阿里云数据表明多数缓存块利用率低。LMCache将缓存管理独立,解决性能问题,其CacheBlend技术复用缓存,适配多引擎和存储后端。

AI工程化
开源动态8

别让AI一上来就“进厂打螺丝”:智源悟界·Orca要先教模型理解世界如何变化

智源研究院悟界·RoboBrain Orca Team发布技术报告Orca,探索模型是否理解世界状态变化。Orca尝试在统一世界潜空间学习状态与规律,受海外关注。它先学世界表征,有独特学习方式,经实验验证效果良好。

量子位
算法论文8

一篇19种自进化Agent Skill框架最新综述

这篇来自Rutgers大学和UNC Charlotte的survey,首次系统梳理Agent技能的进化与评估全貌,覆盖19种技能进化方法和10个评估基准。指出当前评估体系有诸多不足,如无法追踪技能多轮反馈后是否变好等。

PaperAgent
算法论文8

刚刚,Anthropic新作:大模型意识被发现了

Anthropic 最新研究发现 LLM 有可被语言化报告的全局工作空间(J - space),用 Jacobian Lens 技术能读出模型思考概念、干预推理,还可暴露其未说出口的意图,为 AI 安全审计提供新途径。

PaperAgent
新闻资讯7

所有人在让Agent更强,YC却投了一家靠Agent翻车赚钱的公司。

YC孵化的新公司Mount给AI Agent卖保险。如今企业大量使用Agent,但翻车规模也在扩大。Agent频繁出事或因引入新型债务,工程手段只能降低风险,剩余风险可被保险覆盖。YC CEO有独特比喻。

探索AGI
8

6.2K Star!25 种风格配方让 AI 前端审美直接拉满!garden-skills把这事做彻底了。

AI 站点界面同质化严重,开发者陷入享受便利又抱怨产出同质化的矛盾。开源项目 garden - skills 由 ConardLi 开发,是面向 AI 编程代理的技能集合,解决了界面审美和流程不稳定问题,有多种亮点与安装方式。

开源星探
推荐文章7

为什么堆算力救不了大模型

文章指出大模型和人类大脑归纳规律路径不同,AI追求精确但脆弱的拟合,人追求粗糙但不变的压缩。大模型在可收敛系统表现惊艳,不可收敛系统则崩盘,未来AI产品核心是打造可收敛封闭环境。

AI科技评论