「未对齐行为」共找到 1130 篇相关文章
刚刚!UCLA杨林团队证明:仅凭提示词,Gemini 2.5 Pro就可以拿到IMO2025金牌
加州大学洛杉矶分校杨林和黄溢辰撰写论文,阐述利用Gemini 2.5 Pro解决2025年IMO竞赛5道题达金牌水平。设计解题者和验证者构成的自我验证流水线,用双提示词系统迭代,还规避数据污染问题。
Transformer死角,只需500步后训练,循环模型突破256k长度泛化极限
线性循环模型能处理极长序列,是相比Transformer的关键优势,但过去循环模型性能不足且难以泛化。CMU等研究者证明,通过简单训练干预,循环模型500步后训练可突破256k长度泛化极限。
Anthropic承认模型降智后仍放任其偷懒?Claude Code用户信任崩塌中
此前大模型厂商未正面承认‘降智’,OpenAI 研究科学家称是心理错觉。但 Anthropic 公开承认旗下 Claude Opus 4.1 和 Opus 4 质量降级,然而问题未解决,Claude Code 用户信任崩塌,纷纷转向 GPT - 5。
华人团队让AI把表格“翻译”成问题,检索速度×5
表格检索在RAG里是小众问题,传统表格问答系统有Retriever和Reader组件,关键是对齐表格与问题语义。QGpT能生成模拟问题,使表格语义更丰富、对齐更准确,分离线、在线阶段,训练后可提升检索收益。
16 个月、45 万资金投入,一款 AI 社交产品的创业失败复盘
作者复盘AI社交产品“抱抱窝”创业失败经历,涉及方向选择、团队搭建、时间资金把控、团队沟通等问题,还给出经验建议,如选方向要有标准,团队开发股份占比应合理,明确时间表等。
让龙虾看懂屏幕!谷歌多模态新成果,文本图像视频音频进同一空间
谷歌发布首个原生多模态嵌入模型Gemini Embedding 2,将文本、图像、视频、音频和文档映射进同一嵌入空间,支持多模态混合输入,为AI Agent“看懂”世界提供关键基础,已展开公测。
智商276的世界第一持有者,正式向马斯克申请加入Neuralink!
韩国人YoungHoon Kim自称智商276,公开向马斯克发加入Neuralink的“求职信”,介绍其开发的认知增强软件及商业模式,网友反应不一,同时文章探讨了其智商数值的可信度。
比Sora更疯狂!英伟达AI让机器人「做梦」修炼,无师自通直接上岗
英伟达新研究项目DreamGen用视频生成模型让机器人在神经网络生成的「梦境世界」自主探索学习。它能让机器人掌握新动作、泛化到新环境,合成数据暴涨333倍,还引入DreamGen Bench用于视频生成基准。
看到AI创作者不断被盗用和侵权,我有话想说。
本文讲述AIGC艺术家海辛、阿文、Wenvis作品被盗用,一家新公司拿他们作品当客户案例接单。创作者维权艰难,作者借此呼吁大家保护创作者权益,给行业敲响警钟。
Meta 开源 Pyrefly,Rust 中的高性能 Python 类型检查器
Meta 开源处于 alpha 阶段的 Pyrefly,它是用 Rust 编写的高性能 Python 类型检查器,灵感源于 Pyre 等工具,旨在取代 Instagram 代码库的 Pyre。它性能出色,还计划今年夏天进 beta 阶段。