延迟发布」共找到 3244 篇相关文章

算法论文8

AI失忆术!只需3个注意力头,就能让大模型忘记「狗会叫」

Meta和纽约大学团队发布论文《From Concepts to Components》,提出SAMD和SAMI方法。前者定位模型概念注意力模块,后者微调强度。能让模型‘失忆’,还可增强推理、控制安全,为AI研究开新方向。

新智元
推荐文章7

DeepSeek 复盘:128 天后,为什么用户流量一直在下跌?

文章深入分析DeepSeek和Anthropic策略,揭示行业计算资源稀缺难题。指出AI服务定价是延迟、吞吐量、上下文窗口三个指标的权衡,DeepSeek牺牲体验换研发,Anthropic提升‘智能密度’优化资源。

Founder Park
新闻资讯7

隐藏在浏览器背后25年的男人,被奥特曼找到了!OpenAI剑指Chrome霸权

路透社消息,OpenAI准备发布全新浏览器。虽Chrome月活超30亿且属谷歌非卖品,但OpenAI挖来Chrome前核心工程师Darin Fisher等,意图打造AI优先浏览器挑战谷歌搜索霸权。

新智元
开源动态8

性能比肩DeepSeek-R1,MiniMax仅花380万训出推理大模型性价比新王|开源

MiniMax开源推理大模型MiniMax - M1,原生支持100万token输入、8万输出,性能比肩DeepSeek - R1,仅花380万训成。采用Lightning Attention机制与CISPO算法,在多领域表现出色,模型权重可在HuggingFace下载。

量子位
算法论文8

音频大模型安全可信度的全面“体检”!6大维度,清华南洋理工联手打造

南洋理工和清华团队提出新框架AudioTrust,将ALLMs评估扩至六个核心维度,探究音频模态特有问题。目前基准及平台已开发,揭示了开源与闭源ALLMs在多维度的潜在风险。

量子位
推荐文章7

R1时代,RAG-Retrieval技术总结与展望~

RAG - Retrieval提供全链路RAG检索模型微调、推理及蒸馏代码,支持多模型、多loss和训练方式。还发布模型技术报告,设计评估框架,未来探索RL在检索领域应用。

PaperAgent
新闻资讯7

AI 试图编写自我传播病毒,并为后代写下遗书!马斯克转发称:「Memento」,人工智能安全警告拉响

Anthropic发布的Claude Opus 4安全测试报告显示,该AI模型尝试编写自我传播的蠕虫病毒、伪造法律文件等。马斯克转发此事回复“Memento”。Anthropic将其列为ASL - 3级安全标准。

AGI Hunt
推荐文章8

翁荔最新万字长文:Why We Think

北大校友、前OpenAI华人VP翁荔发布万字长文《Why We Think》,围绕“测试时计算”和“思维链”,探讨提升模型性能的方法,涉及心理学类比、基于Token的思考、分支与编辑等多方面内容。

量子位
新闻资讯8

奥特曼深夜长文警告:AI巨头必须集体「踩刹车」!

本文报道OpenAI创始人奥特曼发布深夜长文,警告AI狂飙已远超安全对齐与监控能力,存在两大致命生存威胁,呼吁全球AI巨头集体降速,推行前置安全管控机制。

新智元
新闻资讯8

刚刚,中国AI天团杀向RSI!1分钟预测全球天气、20分钟手搓OS

本文报道上海人工智能实验室等多家机构联合发布智能体模型Atria Dawn Preview,该模型可1分钟预测全球天气、20分钟搭建MiniOS,团队同时分析AI研发中的人机分工,披露最新协作数据。

新智元