「AI预训练范式」共找到 11383 篇相关文章

新闻资讯8

Google 发了个压缩算法,内存砍 6 倍,速度快 8 倍,精度零损失

Google Research发布TurboQuant压缩算法,将在下月ICLR 2026正式发表。该算法把大模型的KV Cache压缩到3 bit,内存降6倍、速度快8倍且精度零损失,解决了传统算法的压缩开销问题。

AGI Hunt
算法论文8

腾讯混元TurboS技术报告首次全公开:560B参数混合Mamba架构,自适应长短链融合

腾讯公开混元TurboS技术报告,该模型是超大型Hybrid Transformer - Mamba架构MoE模型,融合Mamba与Transformer架构优势,有自适应长短思维链机制,激活参数56B。在多评测中表现佳,推理成本低。

AI前线
新闻资讯7

你天天用的Claude和Codex,Meta内部不让随便用了

今年5月Meta给工程师划红线,限制用Claude Code和Codex,因其太好用。Meta组建团队自研编程助手MetaCode,担心外部模型输出渗进训练数据,出现“蒸馏陷阱”,且能省钱。

新智元
新闻资讯7

Rust 天花板级大神公开发帖找工作:3000 次核心提交,不敌 “会调 OpenAI API、用 Cursor”?

Rust 编译器核心贡献者 Nicholas Nethercote 和 Michael Goulet 因团队缩编等原因公开找工作。Nicholas 称 AI 吸走大量资金与注意力,使 Rust 项目资源减少。同时,Unix 联合创始人质疑 Rust 能否取代 C。

AI前线
产品应用7

超 10 万人都在看!Qwen3重塑文本嵌入与重排序技术版图

文本嵌入和重排序是NLP和信息检索关键组件。Qwen3 Embedding、Qwen3 Rerank模型基于Qwen3基础模型构建,有三种参数尺寸。文章介绍其架构、训练方案,还给出实战代码。

CourseAI
7

离开Meta后,田渊栋刚刚官宣创业了

离开Meta后,田渊栋参与创立Recursive_SI。该初创公司致力于打造可自主实验、自我改进的AI,已筹集6.5亿美元,估值46.5亿美元。团队成员经验丰富,在递归自我改进方向有深厚学术积累。

机器之心
新闻资讯8

这次,Token要直接发给学生,每人30万元

AI时代Token已成为核心科研资源,高校学生普遍面临Token匮乏、科研试错成本高的痛点。腾讯启动第二届青云奖学金,为每位获奖学生提供30万元Token额度加20万元现金,还配套产业交流资源。

机器之心
开源动态7

Meta把内部设计系统开源了,支撑内部13000+应用,专为Agent调优

Meta开源的Astryx大更新,改造成Agent适配设计系统。它已在Meta内部演进8年,支撑13000+应用,提供150+可访问、可主题化的UI组件及开发工具,让人和AI用同一套语言。

开源AI项目落地
新闻资讯7

双核发布!“幻镜”第四季+“微笑曲线”计划亮相广电媒体融合大会首创郎园2026年5月13日 15:57 北京 听全文

第六届中国(北京)广电媒体融合发展大会举行,首创郎园赵春燕发布“幻镜”AI视听测评季第四季及“微笑曲线”视听IP运营扶持计划。前者构建测评体系,后者打通视听IP全链路。

郎园Station
新闻资讯7

Sam Altman :GPT-6已经在路上,DeepSeek是OpenAI开源重要因素

Sam Altman称GPT-6已在路上,节奏比GPT4到GPT5间隔更快,记忆是其重要方向。他还认为美国低估中国AI,像DeepSeek等中国开源系统是OpenAI开源重要因素。

AI寒武纪