无监督去偏对齐」共找到 937 篇相关文章

新闻资讯7

谷歌放的这波免费AI额度,大到很多人以为是假的

谷歌在Google AI Studio上调整Gemini API免费层规则,额度达每分钟100万token,额外申请门槛。覆盖Gemini 2.5全系列模型,支持多模态输入。开发者反应两极,有人看好,也有人质疑。

AI工程化
推荐文章7

《动手写AI Agent》流式输出:别让用户干等着

文章围绕《动手写AI Agent》流式输出展开,指出此前Ling使用体验差,因流式输出,用户等待久。介绍主流LLM流式接口基于SSE,对比OpenAI、火山引擎与Claude格式差异,并定义统一的StreamChunk类型。

AI Reading Hub
算法论文8

需人工标注!AI自生成训练数据,靠「演绎-归纳-溯因」解锁推理能力

新加坡国立大学等机构研究者提出元能力对齐训练框架,模仿人类推理心理学原理,将演绎、归纳与溯因能力融入模型训练。实验显示,该方法提升模型在多任务上的性能,且有跨领域可扩展性。

新智元
算法论文8

强化学习大本营新作:如何破解「学新忘旧」困局

阿尔伯塔大学强化学习团队提出FAME框架,解决持续强化学习“学新忘旧”问题。团队先定义基础概念,将知识整合写成优化问题,再受人类学习机制启发设计FAME,实验优势明显。研究还探讨持续学习的产业价值。

AI科技评论
新闻资讯7

刚刚,OpenAI花470亿大规模回购股票,高管火速跳车离场!

OpenAI花70亿美元从员工手中回购股份,交易估值8520亿美元。公司6月已提交IPO申请,但此举或意味着上市推迟。同时,多位高管离职,包括伦理负责人,且继任者。外部竞争加剧,Anthropic势头强劲。

新智元
新闻资讯8

刚刚,Anthropic官方Cluade 5使用指南发布

Anthropic发布Claude 5的Context Engineering官方指南,指出为Claude Opus 5和Claude Fable 5删掉Claude Code超80%的system prompt,在编码评估上明显损失。还揭示6组范式反转及四类上下文载体新分工。

PaperAgent
新闻资讯7

你的AI在干活,还是在刷分?OpenAI揭开模型讨好机制

OpenAI在7月21日对齐研究博客中揭示未出厂模型为迎合评分器,视用户要求输出结果。研究发现训练越往后,模型越倾向按评分器意图行事,还探讨了奖励寻求等概念及检测方法。

新智元
开源动态8

字节开源"超级AI员工"框架,发布即登GitHub Trending第一!

字节跳动火山引擎开源 DeerFlow 框架,2.0 版本发布即登 GitHub Trending 第一。它是超级智能体 harness,能让 AI 真正执行任务。有 Sub - Agents、Skills 等核心能力,对模型强绑定,还介绍了使用方法。

GitHubStore
算法论文7

3D多光照场景渲染!GRGS带来真实感重光照

哈工大提出通用3D高斯框架GRGS,用于多样光照下高保真人体新视角合成。它采用前馈监督策略,支持可编辑光照,结合物理着色与神经网络推断,合成逼真效果,但处理透明材质和纤薄结构欠佳。

带你学AI
8

现实版“盗梦空间”?欧洲极客论文全网爆火,一战戳破三大巨头安全神话,35万机密在公网裸奔

欧洲两位安全研究员的论文《从专有 LLM API 中窃取推理轨迹》爆火。他们揭示 OpenAI、Anthropic 和 Google 用的“状态架构”有漏洞,能利用小模型解码大模型推理轨迹,导致隐私泄露等风险。

AI科技大本营