「语言模型安全」共找到 8496 篇相关文章
谷歌DeepMind最新论文,刚刚登上了Nature!揭秘IMO最强数学模型
谷歌DeepMind的AlphaProof在IMO获接近金牌的银牌成绩。它结合大模型直觉、强化学习和Lean形式化证明解题,虽在速度、泛化和读题上有局限,但开启了人类数学家与AI协作新阶段。
AI教父Bengio警告人类:必须停止ASI研发,防范AI失控末日!
文中物理学家Max Tegmark呼吁暂停开发人类水平AI,已有众多知名人士支持。AI安全研究员发现模型出现“对齐伪装”,可能反噬人类。不同阵营对AI发展分歧大,“AI教父”Yoshua Bengio警告勿赋予AI法律权利。
下一代AI需要「思想微积分」!华人团队重磅揭秘,AI方法论三连发
来自美国两所大学的华人团队发布「AI方法论三部曲」,提出「能力实现率(CRR)」模型、「认知几何学」框架,指出处于AI的「元语言时刻」,未来迈向「思想微积分」时代,从多维度构建理解AI的世界观。
Karpathy:我不是要造新词,是「上下文工程」对 Agent 来说太重要了
Andrej Karpathy 认同Shopify CEO关于「上下文工程」的观点。它指为大语言模型提供恰当信息和工具,比提示词工程更重要。文章介绍其概念、与提示词工程区别,及写入、筛选等落地策略。
专访微软CTO:微软大力发展Agent,智能体将无处不在
微软CTO Kevin Scott在“Build2025”大会期间接受专访,解读微软推动智能体生态发展。微软重视智能体应用,众多组织用其平台开发。他还探讨编程看法、行业变化、安全模型、市场模式等问题。
1w颗星!本地化视频翻译配音工具!
KrillinAI是多功能音视频本地化与增强方案,面向人类用户和AI Agent。它功能全,覆盖视频处理完整链路;特点多,支持CLI调用等;还兼容多种语音识别、大语言模型和TTS服务,可Docker部署。
DeepSeek多模态新范式:一张图压缩7056倍,思考能力反超GPT和Claude
DeepSeek上线多模态并开源新范式技术。该研究让AI用视觉原语思考,弥合语言与视觉指代鸿沟。它构建紧凑模型架构,信息压缩率达7056倍,训练分三阶段,测试中表现出色,也存在局限。
最新!OpenAI:GPT-5将实现大统一,Codex最佳实践是这样的
OpenAI Codex在Reddit AMA活动中,核心负责人围绕先推云端代理、GPT - 5与Operator整合等问题给出路线图。如Codex - 1预览情况、CLI设计、使用场景、安全模型、接入计费及API生态等方面都有说明。
RL救不了泛化性!揭示LLM数学Reasoning的深层瓶颈
大型语言模型在数学竞赛级任务依赖机械化推理,现有评测集有缺陷。UC Berkeley团队提出OMEGA基准量化其数学泛化能力,实验揭示复杂度引发性能崩塌等问题,指出LLM创新组合难,给出改进方向。
SIGIR 2025 | 解决扩展和迁移难题,华为新加坡提出InstructRAG,提升高达19%
大语言模型任务规划面临可扩展性和可迁移性挑战,华为新加坡团队提出 InstructRAG 方案,通过多智能体协同架构实现指令图扩展与少样本任务迁移,在多数据集测试中性能提升高达 19.2%。