后Transformer架构」共找到 3752 篇相关文章

算法论文8

当SFT遇上RL:基于样本学习阶段的动态策略优化机制

在大模型推理能力增强研究中,SFT和RL两种训练范式难有效融合。研究团队提出DYPO动态策略优化方法,先判断样本学习阶段再匹配优化路径,在多场景实验中表现出色,不过有实验边界。

量子位
产品应用7

The Batch: 954 | Kimi K2.6 挑战开源权重模型领先者

Moonshot AI升级的Kimi K2.6是1万亿参数的视觉 - 语言模型,专为代码生成设计,性能与Qwen3.6 Max Preview等相当,略逊顶级闭源模型。其功能多,幻觉率低,模型权重可免费下载。

DeeplearningAI
新闻资讯7

马斯克22万张GPU全卖给Claude用:5小时限额翻倍,双方合作建太空算力

马斯克和Anthropic签署算力合作协议,将旗下Colossus 1超算集群全部给Claude用。此前马斯克抨击过Anthropic,合作态度转变。此交易或改写AI算力格局,且三家计划IPO的公司故事也因此改写。

量子位
产品应用8

全域感知,一键部署:“星元智能体”开启国产AI落地新范式

4月29日,数字感知芯片技术全国重点实验室联合中星微团队发布‘星元智能体’。它基于XPU芯片,完成从芯片到智能体跨越,架构创新破算力瓶颈,还破解数据困局,已在多地试点,未来将推动AI产业发展。

芯师爷
产品应用7

Lyft 使用 AI 和人机协同扩展了全球范围内的本地化能力

Lyft 实现 AI 驱动的本地化系统,加速应用与网页内容翻译。新系统结合大语言模型、自动评估与人工审核,将翻译周期从数天缩至分钟级,兼顾质量与适配性,还分批量和实时翻译架构处理不同场景。

InfoQ
新闻资讯7

Anthropic最强网络攻防大模型Mythos,美国国安局早就一直在用了

美国政府准备向多个联邦机构开放Anthropic新模型Mythos的‘修改版’,虽国防部将Anthropic拉黑,但国安局一直在用Mythos。白宫先明确模型接入的权限、用途等边界,再推进接入,各方对其态度有分歧。

新智元
算法论文8

LLM 仅靠自身就能增强推理?SePT 给出简洁在线自训练范式

多数推理训练方法依赖外部信号,SePT仅用模型自身生成的答案自训练,能提升推理能力,数学推理任务准确率升10个点。它核心简洁,设计关键是温度解耦等,不损模型通用能力,代码易迁移复现。

机器之心
算法论文7

人多不管用!智能体团队别盲目扩张,最新综述给出三大维度

随着大语言模型驱动的多智能体系统快速发展,核心问题是有些系统规模扩大会失稳、低效。美国、英国和澳大利亚研究人员提出三维分类框架描述大规模智能体网络,指出真正决定系统表现的是三种机制组合。

新智元
产品应用7

谷歌向左、李飞飞往右,阿里世界模型「快乐生蚝」杀出第三条路

阿里推出世界模型HappyOyster(快乐生蚝),基于原生多模态架构,有漫游和导演两大核心功能,可实时构建和交互。与文生视频模型不同,它能随时被干预。虽世界模型尚处早期,但应用场景广泛。

机器之心
算法论文8

不写Prompt,连按Tab完成重构:蚂蚁CodeFuse团队提出无指令代码编辑框架NES

在AI coding工具快速演进的当下,蚂蚁集团CodeFuse算法团队在FSE 2026提出无指令代码编辑框架NES。它从历史编辑轨迹学习开发者意图,有双模型架构,实现分三环节,重构交互链路,提升开发者体验。

机器之心