「模型优势」共找到 8428 篇相关文章

开源动态7

NextStep-1:一次在图像生成上自回归范式的探索

阶跃星辰团队探索自回归图像生成新路径,推出 NextStep-1。它直接在连续视觉空间自回归生成,架构简洁,实现端到端训练。模型有高保真生成和编辑能力,Benchmark 表现佳,但也面临稳定性等挑战。

机器之心
算法论文8

微调重要表征以增强思维链的推理能力

团队提出关键表征微调(CRFT)方法,通过信息流分析识别和优化关键表征。在八个数学和常识推理基准及两个模型系列验证其有效性,能提高推理准确率,学习参数量低,还适应少样本场景。

深度学习自然语言处理
推荐文章8

用子模优化做文本选择、段落重排和上下文工程

文章围绕子模优化展开,介绍其在文本选择、段落重排和上下文工程中的应用。指出当前重排器的缺陷,通过子模优化可解决冗余问题。还给出实验结果,凸显其优势,如理论保证、自动停止机制等。

Jina AI
新闻资讯8

突发!OpenAI紧急暂停GPT-6训练

OpenAI奥特曼官宣暂停下一代旗舰模型强化学习训练两周,原因是确保安全等标准跟上能力水平。触发因素有Hugging Face事故和Astra达安全红线,后续将让AI监管AI,加固三道安全防线。

新智元
新闻资讯7

OpenAI 和 Anthropic “杀”红了眼,谷歌成为最大受害者

6月AI人才市场,谷歌7天内损失四位技术元老,分别加入OpenAI和Anthropic。这引发外界关注,有人质疑谷歌AI处境。DeepMind CEO哈萨比斯回应称,判断AGI竞赛输赢不能只看短期,谷歌仍有优势。

InfoQ
新闻资讯8

超150位全球AI一线技术专家齐聚巴黎,这场大会到底聊了些什么?|GOSIM Paris 2026圆满收官

5月6日,GOSIM Paris 2026进入第三天,议程转向技术实践。超150位全球AI专家齐聚,探讨模型推理优化、开源社区治理等。Niko Matsakis等分享前沿观点,还有五大主题论坛及工作坊,展示开源AI生态成果。

AI科技大本营
新闻资讯7

13人干翻Transformer!新架构SSA算力暴减千倍,成本仅Opus 5%

一款基于SSA架构的AI模型SubQ横空出世,其上下文高达1200万Token,计算量比Transformer暴减1000倍,成本不到Claude Opus的5%。打造它的Subquadratic公司仅13人,产品发布后引发AI社区不同反应。

新智元
开源动态8

CVPR 2026 | 谷歌DeepMind重磅开源多模态TIPSv2:实现Patch-Text对齐的最优表现

谷歌DeepMind推出多模态TIPSv2,解决图像块与文本嵌入对齐难题。它有三大核心技术创新,在9项任务和20个数据集表现出色,特征图优势显著,且配套生态完善,为AGI预训练指明方向。

机器之心
新闻资讯7

Meta员工空转AI只为浪费token!烧的多挣的多,日均消耗2万亿

Meta内部在首席AI官亚历山大王推动下,员工为抢夺虚荣头衔展开“Token竞技”,日均消耗两万亿Token。这源于扎克伯格重写代码库要求,首席技术官支持资源投入。新模型将半开源,嵌入社交业务。

量子位
产品应用8

访谈|Codex 团队如何用自己的产品构建产品——整个 Spec 只有 10 个要点

OpenAI Codex 团队产品规格文档极简,仅 10 个要点。团队运作如‘海盗船’,规划只做近期和远期,不做中期。Codex App 诞生源于模型能力提升,团队以 power user 为导向设计产品,还谈到 PM 角色转变和招聘标准。

宝玉AI