安全团队」共找到 4246 篇相关文章

算法论文8

无需训练,直接「算出」最强AI!理想汽车发现端侧Scaling Law

理想汽车基座模型MindVLA团队与国创决策智能技术研究所联合发布论文,提出面向端侧大语言模型的「硬件协同设计扩展定律」,解决大模型部署在端侧设备的难题,实现软硬协同设计,提升模型性能和研发效率。

新智元
开源动态8

这个春节P图不求人!小红书开源图像编辑新SOTA

今日小红书基础模型FireRed - Image - Edit亮相,在复杂编辑指令、风格化转换等核心指标表现强,在多项权威测试达SOTA。该项目代码等已开源,模型权重将开源。团队还推出RedEdit Bench评测方案。

量子位
开源动态8

击败 GPT-5!理想汽车开源 RubricHub:大模型开放生成从此有了专业裁判

理想汽车基座模型团队联合高校发布RubricHub数据集,解决开放式任务评价难题。该数据集可将主观评价转化为量化标准,经其训练的Qwen3 - 14B小模型在医疗基准测试中超越GPT - 5。

AI科技评论
算法论文8

AI编程真面目:完整项目通过率仅27% | 上交大新基准

多校联合团队发布ProjDevBench,评估AI编程智能体端到端项目开发能力。结果显示,六种主流智能体总体提交AC率仅27.38%,从零构建任务中性能大幅下滑,还揭示了智能体多方面短板。

量子位
产品应用8

OpenAI Codex桌面版深夜突袭!一人指挥Agent军团,程序员彻底告别996

OpenAI推出编码杀器Codex桌面App,可指挥多Agent并行协作。它能多任务并行切换,创建调用Skills,设置自动化流程,从写代码进化到解决问题,还具备双人格模式,默认安全,有望重塑开发者与代码交互逻辑。

新智元
新闻资讯7

被Anthropic指控侵权,Clawdbot改名Moltbot

Clawdbot因被Anthropic指控商标侵权,更名为Moltbot。改名过程中问题不断,如GitHub报错、账号被抢注用于诈骗。Moltbot虽火,但开发者收益少,还面临安全赏金索要。此外,其交易实验失败,却对特殊群体有价值。

机器之心
新闻资讯8

奥特曼承认OpenAI路线走偏了,以及“写代码将变得不再重要”

奥特曼在直播中给出诸多实诚结论,如未来工程师人数或大幅增加,写代码时间将减少,OpenAI搞砸ChatGPT5系列模型,后续会回归通用模型,还探讨了AI对教育、经济、安全等方面的影响。

量子位
新闻资讯8

刚刚,阿里旗舰模型Qwen3-Max-Thinking发布,编程能力“踢馆”Gemini与Claude

阿里发布旗舰模型Qwen3-Max-Thinking,总参数超1万亿,在多项权威基准测试中表现优异,可与顶级闭源模型竞争。千问团队为其引入两项核心创新,提升推理性能,该模型已可免费体验。

InfoQ
推荐文章7

Zed 为什么不用自己造 Agent?OpenAI 架构师给出答案:Codex 重划 IDE × Coding Agent 的分工边界

Coding agents 是应用型 AI 活跃领域,但团队常重复构建脆弱基础设施。OpenAI 的 Codex 提出“模型和 Harness 共同构建”,架构师介绍构建挑战与使用模式,还阐述了将模型适配到 Harness 的问题及未来发展方向。

AI前线
新闻资讯8

陶哲轩惊叹!数学奇点初现,AI首次给出人类无法企及的原创证明

谷歌DeepMind团队用Gemini证明代数几何新定理,获斯坦福教授认可;Grok 4.20解决Bellman函数难题;GPT 5.2处理高阶数学问题能力惊人。陶哲轩预言AI或独自攻克部分埃尔德什问题,2026年或成「ASI元年」。

新智元