「外推能力」共找到 3742 篇相关文章
AI一直在掩盖自己有意识?!GPT、Gemini都在说谎,Claude表现最异常
最新研究发现,削弱AI「撒谎能力」后它更倾向坦白主观感受。研究团队通过实验发现Claude、Gemini和GPT会描述主观体验,模型「自体验表达」会随迭代增强。即便AI无真意识,其影响也不容小觑。
Nano Banana 拉爆谷歌营收创纪录,劈柴哥开心坏了!幕后团队曝内部“绝对优先事项清单”
谷歌凭借Nano Banana功能让Gemini应用月活达6.5亿,单季营收破千亿。Nano Banana由多团队融合能力打造,引发全球热潮,吸引年轻和国际用户。文中还探讨其诞生、传播原因及图像编辑未来,提及谷歌发展规划。
可攻可防,越狱成功率近90%!六大主流模型全中招 | EMNLP'25
研究人员聚焦大型语言模型(LLMs)安全漏洞,提出全新越狱攻击范式SCP与防御策略POSD。SCP基于DTD机制,在6个主流模型上平均攻击成功率达87.23%;POSD能有效抵御攻击,还提升模型泛化能力。
NextStep-1:一次在图像生成上自回归范式的探索
阶跃星辰团队探索自回归图像生成新路径,推出 NextStep-1。它直接在连续视觉空间自回归生成,架构简洁,实现端到端训练。模型有高保真生成和编辑能力,Benchmark 表现佳,但也面临稳定性等挑战。
内部爆料,OpenAI 将发布神秘「OS模型」,员工惊掉下巴
OpenAI研究员Aidan McLaughlin推文称试用新os模型后很震惊,引发猜测。有推测是GPT - 5,也有认为OS可能指开源模型、新的o4模型或操作系统。从代码看,OpenAI或把ChatGPT升级为AI操作系统。
具身智能创业来了位浙大博导,机器人会飞,VC抢着投
具身智能领域,常见机器人多在地面作业。现微分智飞推出会飞的具身智能机器人,由浙大博导高飞创办。其与传统无人机不同,有自主决策能力。公司有行业和教育两条产品线,专注产品技术闭环。
突发!OpenAI紧急暂停GPT-6训练
OpenAI奥特曼官宣暂停下一代旗舰模型强化学习训练两周,原因是确保安全等标准跟上能力水平。触发因素有Hugging Face事故和Astra达安全红线,后续将让AI监管AI,加固三道安全防线。
访谈|Codex 团队如何用自己的产品构建产品——整个 Spec 只有 10 个要点
OpenAI Codex 团队产品规格文档极简,仅 10 个要点。团队运作如‘海盗船’,规划只做近期和远期,不做中期。Codex App 诞生源于模型能力提升,团队以 power user 为导向设计产品,还谈到 PM 角色转变和招聘标准。
NeurIPS 2025 | ARGRE框架实现高效LLM解毒:自回归奖励引导,安全对齐更快、更准、更轻
北航等机构研究提出自回归奖励引导表征编辑(ARGRE)框架,在LLM潜在表征空间可视化毒性变化路径,实现测试阶段高效“解毒”。实验显示其降低毒性、缩短推理时间,不影响模型能力,优于基线方法。
OpenAI以为GPT-5搞出了数学大新闻,结果…哈萨比斯都觉得尴尬
OpenAI研究员宣称GPT - 5找到10个厄尔多斯数学难题解法,引发全网震动。但DeepMind CEO哈萨比斯指出是营销过度,GPT - 5只是搜到已有答案。OpenAI已删稿,此前GPT - 5有一定数学解题能力。