「安全团队」共找到 4228 篇相关文章
九成以上模型止步白银段位,只有3个铂金!通用AI下半场评测标准来了
OpenAI研究员姚顺雨提出AI发展步入新阶段,下半场关键在评估模型真实智能。新加坡国立大学等团队提出“通才智能”评测框架,剖析多模态大模型短板,推出五级评估体系和测试集,测试结果暴露模型弱点,引发社区积极反响。
刚刚,OpenAI GPT-6 Astra震撼发布!AGI时代来了
OpenAI正式发布GPT - 6 Astra,总裁称已到AGI时代。该模型定位为“世界上最智能、最对齐的模型”,在多领域表现出色,能力强、速度快、成本低,还具备“关键级”网络安全能力,将逐步开放给用户。
AI软递归自我提升,Hassabis夜不能寐:人类已至奇点山脚
AI递归自改进和研究自动化正从概念走向现实,哈萨比斯称人类站在「奇点山脚」。Claude已独立编写超80%代码,Anthropic工程师效率大幅提升。但AI递归也带来安全风险,全球实验室陷入「囚徒困境」。
国产新模王Qwen3.7-Max,海外开发者已经沸腾了
阿里通义千问团队发布的 Qwen3.7-Max,或为面向 Agent 时代的旗舰模型。它能自主跑 35 小时、完成 1158 次工具调用,内核优化不掉线,多项评测领先,应用场景丰富,已上线且兼容主流框架。
监管正式落地严查,全国首部AI产品合规标准来了
自2023年相关办法发布,国家监管网越织越密,AI产品合规成企业必答题。《生成式人工智能产品安全与合规指南》团体标准应运而生,构建全生命周期合规体系,有全链路、全场景、全配套亮点,还公开征集起草单位与专家。
智谱公布“降智”的秘密:Scaling不可避免的痛
智谱最新技术博客大倒苦水,称从GLM - 5以来遭遇「Scaling Pain」。团队排查出高负载下推理状态管理等问题致异常,还给出避坑指南,如在线异常监控策略,优化后系统更稳定,吞吐量提升。
Claude Opus 4.7深夜上线,评分碾压
周四晚间,Anthropic 宣布 Claude Opus 4.7 全面上市。它在高级软件工程、视觉效果上表现出色,多项基准测试优于 Opus 4.6。还具备新特性,如自动模式等,安全性能与 Opus 4.6 相似。此外,Anthropic 还有相关更新。
最鲁棒的MLLM!港科大开源「退化感知推理新范式」 | AAAI'26
多模态大语言模型(MLLMs)在真实世界视觉退化下性能崩溃,制约产业落地。港科大等团队开源的Robust - R1被AAAI 2026接收为Oral,提出显式结构化推理新范式,实现质量与鲁棒性双重突破。
罗福莉首个小米成果!开源具身大模型
正式入职小米不到10天,罗福莉作为核心作者的首篇论文出炉。MiMo团队提出并开源全球首个打通自驾与具身操作领域的跨具身基座模型MiMo - Embodied,在29个Benchmark上霸榜。
Java 30周年献礼:新LTS版本Java 25,服务器内存砍掉22%,AI开发起飞
2025年9月16日,Oracle推出Java 25,这是继JDK 21后首个LTS版本,官方提供八年支持。它含18个JDK增强提案,目标是优化AI运行、安全防护等,在省内存、提速度、简语法等方面均有显著改进。