无监督去偏对齐」共找到 937 篇相关文章

开源动态7

4万星开源项目被指造假!MemGPT作者开撕Mem0:为营销随便造数据,净搞没有意义的测试!

高人气开源智能体记忆项目Mem0在论文中称在LOCOMO上打败所有人,MemGPT联合创始人公开指控其测试意义、数据造假。二者都为解决大模型长期记忆问题,Letta认为能力比工具重要,并给出评估智能体记忆能力的方法。

AI前线
新闻资讯7

GPT-5编程成绩有猫腻!自删23道测试题,关键基准还是自己提的

有人发现OpenAI测试GPT-5编程能力时,用的SWE-bench Verified子集仅477题,自行省略23题。若这些题默认零分,其得分比Claude Opus 4.1低。且该基准还是OpenAI自己提出的。

量子位
新闻资讯7

你和ChatGPT的私密对话正在全网裸奔!网友炸锅:我把ChatGPT当知己,它却把我隐私挂网上

《Fast Company》曝光谷歌搜索现 ChatGPT 用户私人对话,虽部分个人信息,但仍涉及大量深层隐私。OpenAI 称是“短期实验”,将移除相关功能并删索引内容,不过清理未完成,网友对此质疑声不断。

AI前线
算法论文8

借助CoT监管AI?OpenAI、谷歌、Anthropic等罕见联合发文:AI系统安全的新机遇!

OpenAI等支持新研究论文,其指出高级AI不透明性有潜在风险,而‘推理模型’用自然语言推理带来可解释窗口,CoT监控可检测不当行为、发现早期信号等,但也存在使监控性下降的因素。

PaperAgent
新闻资讯7

Meta离职大牛千字「血书」,怒揭黑幕!内斗、抢功、末位裁员,全是毒瘤

Meta前研究员Blankevoort发2000字「血书」,控诉公司文化崩坏、末位淘汰如毒瘤、团队抢功下限。他指出AI业务深陷泥潭,各部门内斗,合作缺失。Meta领导层重视此事,天价挖人能否带来改变存疑。

新智元
算法论文8

数学推理热潮下的冷思考!如何训练真正"全能"的推理模型?

论文评估20余个开源推理模型在多领域表现,发现多数模型数学成功难迁移。揭示微调方法(RL vs SFT)决定能力泛化,SFT像‘填鸭’,RL似‘思维健身’,为构建通用推理智能体提供新路径。

深度学习自然语言处理
新闻资讯8

这一次,真不是狼来了,旧时代一夜终结「GPT-6 Astra与特斯拉Cybercab同日上线」

OpenAI总裁称迎来AGI时代。GPT - 6 Astra实现前所未有的对齐,理解意图大幅提升,能快速完成电脑上的事。投资人实验中,它用一句话构建微型文明。同日特斯拉Cybercab提供出行服务,旧时代或终结。

AI寒武纪
算法论文8

文生图Scaling新变量,被字节Seed团队发现了

ByteDance Seed团队研究发现,文生图模型中自然语言Caption变长,不意味着模型获更多视觉监督,其信息量更能预测训练损失。团队提出Structured Prompt,从两侧提升文本条件,在多任务上取得显著提升。

机器之心
7

苹果把OpenAI窃密细节全部暴露!但草台班子拼音都搞错了…

苹果与OpenAI窃密大战更新,苹果提交初步禁令申请及相关材料,指控OpenAI员工多次蓄意窃密。OpenAI回怼,称苹果虚构协商叙事,其指控据,还质疑苹果权限管理。此前马斯克也曾起诉OpenAI。

量子位
推荐文章7

大厂的AI不限量补贴终会结束!Hermes Agent作者:开源框架真正的狠招是把Claude对Anthropic的忠诚抢过来

科技创作者 Peter Yang 对话 Hermes Agent 作者之一 Karan Malhotra,探讨 Hermes Agent 与其他产品的差异、模型谄媚问题、开源意义等。Karan 指出其独特自我改进系统与专注用户需求特点,还提及让模型更贴合用户的方法。

AI科技大本营