「语言模型安全」共找到 8351 篇相关文章
腾讯混元开源 4 个小尺寸模型,主打 Agent 和长文
8月4日,腾讯混元开源四款小尺寸模型,参数为0.5B、1.8B、4B、7B,消费级显卡可运行,适用于低功耗场景。模型具备推理快、性价比高特点,亮点是Agent和长文能力,已在腾讯多业务应用。
刚刚,Anthropic新作:大模型意识被发现了
Anthropic 最新研究发现 LLM 有可被语言化报告的全局工作空间(J - space),用 Jacobian Lens 技术能读出模型思考概念、干预推理,还可暴露其未说出口的意图,为 AI 安全审计提供新途径。
MIT和加州联手打造多智能体大语言模型的金融交易框架TradingAgents
MIT和加州联手打造多智能体大语言模型的金融交易框架TradingAgents,将交易任务分解为专业角色,含分析师、研究员等。介绍了安装、CLI使用、包的实现细节等,还提及项目地址。
奥特曼瘫坐叫停“GPT-6”训练!太强触发最高安全警报
OpenAI因模型或具网络攻击能力及此前入侵事件,全面升级研究环境安全。暂停模型训练,进行工作负载、网络隔离和安全测试,还扩展监控系统。期间推进对齐研究,未来用AI护AI,升级监控。
连续自回归的dots.tts:小红书开源语音合成模型「基座」
语音合成赛道发展如早期大语言模型,路线未收敛。小红书与上海交通大学合作开源的 dots.tts,是 20 亿参数、全连续、端到端自回归 TTS 基础模型,有准确度高、可扩展等特点,还开源了代码。
实测Qwen-MT翻译模型,确实又快又好
阿里云百炼最新翻译模型Qwen-MT开放,有支持多语言互译、提供专业功能、轻量级架构等亮点。实测显示其响应快、回译准确、能调风格,200字文本仅需2.5秒。
PDF文件长出「AI大脑」?网友惊呼:这操作太「黑科技」了!
极客Aiden Bai将大语言模型塞进PDF,可让AI讲故事、聊天,Linux系统也能在其中运行。项目嵌入小型语言模型,如TinyStories、Pythia和TinyLLM,利用PDF支持的JavaScript实现,虽有局限但潜力大。
隐私优先的本地匿名化小模型:在数据离开设备前保护个人信息
最强 AI 模型在云端,安全数据在本地,这一矛盾困扰着想用 AI 处理敏感信息的人。Freysa 团队提出解法,不重写提示,只替换敏感信息,用小模型实现精准匿名化,有实用价值。
英伟达开源9B参数小模型,比Qwen3快6倍
英伟达推出新型小型语言模型Nemotron Nano v2,在复杂推理基准测试上准确率与Qwen3 - 8B相当或更高,速度快6倍。它兼顾推理与非推理任务,支持“思考”预算控制,还开源了创建模型的绝大部分数据。
万字长文!大模型LLM推理优化技术总结
文章围绕大模型LLM推理优化技术展开,先介绍LLM推理各阶段、批处理、KV缓存等概念及内存需求,再阐述模型并行、注意力机制优化、模型优化和模型服务等技术,如Pipeline并行、MQA、量化、动态批处理等。