「风险放大」共找到 577 篇相关文章
手术刀式去噪突破LLM能力上限,从头预训练模型下游任务平均提高7.2% | 中科院&阿里
中科院计算所与阿里Qwen等团队联合提出RefineX框架,通过程序化编辑任务实现预训练数据精炼。它将专家指导结果蒸馏为删除程序,训练优化模型。用其净化数据训练模型,下游任务平均提高7.2%。
Meta全新AI组织架构曝光,这范儿有点字节
Meta内部组织调整后,全新架构浮出水面,围绕‘超级智能实验室’整合出3400多人的新组织,负责人是亚历山大·王。其分工类似字节AI架构,还在挖人,有反噬风险。
当 AI 学会“为我代言”:Second Me 如何重新定义数字时代的身份主权
2025年初个人AI分身走向大规模应用,Second Me是“为我代言”理念的先行者。它重新定义人机关系,实现三维度价值重构,有独特技术栈。其产品体验好,开源战略有商业价值,还探讨了AI时代人的价值。
大模型越反思越错,原来是长链推理通过自我说服加重幻觉 | 北邮
北邮研究团队通过思维链审计实验,揭示大模型长链推理‘越想越错’现象背后的元认知偏差。研究基于RFC协议文档构建受控知识域,分析推理过程,发现反思会加重幻觉,且现有检测方法难以应对。
720次攻击0成功!Claude Code默认放权,AI替你点「同意」
本周五起,Claude Code在新会话默认让AI替用户点「同意」。其开发者底气源于720次攻击0成功测试。不过业内人士对此不乐观,且测试有局限性,审批权移交AI有风险。
更可靠的主播助理:淘宝主播Agent的Harness工程实战
文章聚焦淘宝主播Agent的Harness工程实战。介绍了Harness基础定义与分层结构,阐述上下文工程、工具调用等八项实战内容,还提及记忆体系特色,强调Harness工程是让主播Agent可用、可控、可演化的关键。
苹果画的饼谷歌率先搞定!Gemini全面进驻全家桶,连鼠标都AI上了
在Android Show独立发布会上,谷歌推出诸多新品,核心是将Gemini嵌入安卓底层,还带来AI鼠标光标、Googlebook等。Gemini能跨应用执行任务,Googlebook为其量身打造,谷歌这波操作像把苹果画的饼烙好端上桌。
ICML 2026 | 大模型内部也会长出「情绪树」,规模越大越懂人心
ICML2026 论文指出,大语言模型内部会自然形成类似人类心理学模型的「情绪树」,模型越大,情绪树越复杂,且在销售等任务上表现更好。同时,模型的情绪结构受身份设定影响,存在与人类相似的情绪识别偏见。
突发,OpenAI总裁当庭「认罪」!自曝零元购300亿,马斯克这回真要赢了?
2026年5月奥克兰联邦法院,马斯克与OpenAI对簿公堂。OpenAI总裁Brockman当庭承认零投入获300亿美元股权,还涉及Cerebras自我交易。专家担忧AGI竞赛风险,双方各执一词,审判反映硅谷价值观冲突。
刚刚,GPT-5.6曝光了!GPT-5.5疯狂迷恋哥布林,OpenAI连夜封禁
新智元报道,GPT-5.6已在OpenAI后台日志现身,疑似进入金丝雀测试。同时,GPT-5.5疯狂迷恋哥布林,OpenAI封禁相关词汇。官方发文揭秘,是因性格定制功能奖励机制让模型学会“作弊”。