「安全测试」共找到 2497 篇相关文章
大模型能“原地”改参数了!字节Seed&北大新论文:测试时推理无需加层重训练
字节Seed和北大研究团队提出In - Place TTT方案,让大模型能“原地改参数”。它复用Transformer的MLP模块,解决现有TTT架构不兼容、计算效率低和优化目标不匹配问题,实验证明可提升模型长文本任务表现。
提升大模型内在透明度:无需外部模块实现高效监控与自发安全增强|上海AI Lab & 上交
大语言模型能力提升引发风险担忧,当前主流用外部“黑盒”监控模块解读模型表征,存在诸多局限。上海人工智能实验室和上海交通大学团队提出TELLME方法,摒弃外部模块,提升模型内部透明度,还提升了输出安全性。
Claude官方击穿高薪、高学历的安全防线!Anthropic点名10大高危职业,但有群人暂时稳了
近日,Anthropic发布研究,描绘AI正替代哪些工作。其构建“实际暴露度”指标,基于Claude对话数据测得。研究列出10大“高危”职业,也指出部分工作不受影响,还揭示高暴露群体特征及青年招聘情况。
视频生成1.3B碾压14B、图像生成直逼GPT-4o!港科&快手开源测试时扩展新范式
香港科技大学联合快手可灵团队推出 EvoSearch 方法,支持图像和视频生成。该方法无需训练和梯度更新,能提升模型生成质量,展现了 test - time scaling 补充 training - time scaling 的潜力,目前论文和代码已开源。
EMNLP25 | 北大x腾讯光子发布 C3 Benchmark:中英双语语音对话模型“地狱级”测试基准,直击语音对话模型软肋!
近年来语音对话模型受关注,但处理人类对话复杂现象的效能缺乏研究。北大联合腾讯光子构建中英双语C3 Benchmark数据集,评估模型应对复杂对话的能力,结果揭示性能瓶颈,为模型优化提供参考,代码和数据已开源。
Qwen 3-235B Aider编程能力击败Claude3.7,成本便宜百倍
Qwen3-235B-A22B在Aider多语言编码基准初步测试中击败Sonnet 3.7 Thinking和OpenAI o1,成本便宜150到600倍。Qwen3-32B准确率超GPT-4.5和GPT-4o ,代码编辑格式正确率达100%。
Kimi推出Kimi Claw,原生集成OpenClaw
Kimi.com原生支持OpenClaw,推出新功能Kimi Claw,可在浏览器标签页运行且全天候在线。有ClawHub访问权限、40GB云存储空间等特性,现开启Beta测试,对特定等级会员开放。
Veo何止生成视频:DeepMind正在用它模拟整个机器人世界
通用型机器人策略发展带来挑战,传统评估方法有局限,前沿视频模型虽有潜力但面临困难。Google DeepMind团队提出基于Veo的机器人策略评估系统,经实验验证有效,展示了视频仿真评估的可行路径。
小企业专属Claude来了!一键接入全套业务流,不用写代码AI自动算账催款
Anthropic推出Claude for Small Business,是全新连接器和工作流包,可嵌入小企业常用工具。操作简便,覆盖多领域,有安全保障,还配套培训课程和线下活动。
刚刚开源就斩获 46K+ Star!生化危机女主在 GitHub 开源了一个本地 AI 记忆系统!
好莱坞女星 Milla Jovovich 针对 AI 记忆痛点,用 Claude Code 开发本地 AI 记忆系统 MemPalace。它存储全部对话,检索快,召回率高、数据安全、扩展性强,适用多类人群。