「可重构计算」共找到 5398 篇相关文章

算法论文8

推翻「预测下一个token」范式!微信AI新研究:把token压缩成连续向量更具性价比

微信AI和清华团队提出新范式CALM,把token打包成连续向量,让大模型从预测下一个token转变为预测下一个向量。实验表明它能减少生成步骤,在平衡性能和计算成本时性价比更高。

量子位
开源动态8

北大字节开源首个时空推理视频模型!思考过程全透明,性能超越GPT-4o

北大和字节联合团队推出开源模型Open-o3 Video,将显式时空证据嵌入视频推理全过程,采用non-agent架构,性能超越GPT - 4o等闭源模型。该模型构建了STGR语料体系,采用双阶段训练,实验表现优秀。

量子位
新闻资讯7

扩散不死,BERT永生!Karpathy凌晨反思:自回归时代该终结了?

苹果前员工Nathan Barry得出BERT本质是文本扩散一步的结论,将表示学习算法改造成生成算法。OpenAI创始员工Karpathy对此沉思,认为生成逻辑在LLM架构中可变。实验证明RoBERTa可转为生成引擎。

新智元
新闻资讯8

中国顶尖科学家数量已超越美国

中国科研正从跟跑变领跑,国际合作领衔比例上升,与美欧渐趋均衡。人工智能等关键赛道加速发展,顶刊与高被引成果、顶尖人才增多。借‘一带一路’放大影响力,重绘全球科技版图。

新智元
开源动态8

SGLang 优化Triton FusedMoE 的一个新技巧​

蚂蚁在SGLang中提交优化PR,针对Fused Triton MoE的Down Projection kernel加入TMA优化,在DeepSeek - R1模型的H200 TP8 prefill场景下性能提升显著,还详细分析了优化背景、思路、实现细节及测试结果。

GiantPandaLLM
产品应用8

刚刚,Cursor 2.0携自研模型Composer强势登场,不再只做「壳」

Cursor 2.0发布重大更新,带来自研编码模型Composer和新协作界面。Composer速度领先,针对软件工程优化;新界面以智能体为中心,可并行运行多智能体,还解决了代码评审和测试瓶颈。

机器之心
新闻资讯7

Sora连更三大新功能!一键打造IP形象,限时免注册码抢占安卓市场

Sora连更三大新功能,包括角色客串、视频拼接、社区排行榜。Sora APP在美国等四国限时取消邀请码限制,卡在安卓版上线节点,意在抢占市场。其角色客串功能可打造IP,转变为社交平台。

量子位
7

14000人原地被裁!亚马逊今日:打工人水深,AI机器人火热

10月28日,亚马逊约1.4万名员工收到裁员通知,占全职员工4%,超80%来自零售业务。公司业绩不错仍裁员,是为用AI增效、资源重组,还押注具身智能,或取代超50万蓝领岗位。

量子位
开源动态7

Glyph:文本转图片解决长上下文困境,智谱把“DeepSeek-OCR”具像化了

传统 token 扩展方式遇算力成本天花板,DeepSeek 与智谱都想到让 AI“看”文字思路。智谱发布 Glyph 框架工程化实现此思路,将文本转图片处理,降低计算成本,有不错效果但也存在排版敏感等限制。

AI工程化
推荐文章8

还在拼命加 GPU?AI 应用规模化的下半场,拼的是这五大软件“新基建”

文章指出 AI 应用规模化下半场,拼的是五大软件“新基建”。从云原生到 AI 原生,应用基础设施面临诸多挑战,如从代码中心到智能体管理等。作者提出构建智能体协作网格、认知记忆平台等五座技术灯塔,助力 AI 原生应用发展。

InfoQ