连续自回归」共找到 1305 篇相关文章

新闻资讯8

从开源狂热到应用为王,AI 正在回归常识

AI行业正发生变化,模型行业对“开源还是闭源”态度转向商业共识,旗舰模型开始闭源;应用变得更重要,应用层机会多;智能体重新定义AI价值边界,推动行业从“模型思维”走向“系统思维”。

MacTalk
新闻资讯8

刚刚!微软 | 发布全新一代研AI芯片Maia 200

微软提前发布研AI芯片Maia 200,基于台积电3纳米工艺,性能超竞品,是其异构AI基础设施重要部分,将支持多个大模型,已部署在美中数据中心,还开放Maia SDK预览。

AINLPer
算法论文7

无需外部数据!AI答实现推理能力进化

卡内基梅隆大学团队提出SQLM框架,这是无需外部数据的我提问模型,含提问者和解答者角色。通过强化学习最大化期望奖励,设计监督奖励函数。实验显示其能提升Qwen2.5 - 3B - Instruct多任务准确率。

量子位
推荐文章8

手工软件工程师的时代已经结束!一位连续创业CTO的判断

连续创业者、Tessi.ai CTO Ben Greene 在访谈中指出,生成式 AI 改变软件工程形态,手工软件工程师时代过去。工程师应转向理解问题、设计系统,具备系统思维、业务理解和与人协作能力,学会“AI 编排”。

InfoQ
算法论文8

清华联手千问重塑归一化范式,让 Transformer 回归「深度」学习

Pre - Norm和Post - Norm是Transformer架构中稳定信号流的关键范式,但面临权衡取舍。近日,清华黄高团队联合千问团队提出SiameseNorm,构建参数共享的平行通路,实现稳定训练并提升性能。

机器之心
开源动态8

小扎又开源了:7B实现监督学习SOTA

Meta发布全新开源视觉模型DINOv3,首次证明监督学习模型能在广泛任务中超越弱监督学习模型。它用无标注方法,扩展数据和模型规模,支持标注稀缺场景,在多任务实现SOTA。

量子位
算法论文8

搜索强化学习SSRL:Agentic RL的Sim2Real时刻

本文由多机构联合完成,引入搜索强化学习SSRL。它利用结构化prompt和format reward提取模型world knowledge,降低幻觉。还探索Sim2Real有效性,验证SSRL训练模型在真实场景泛化性,且所有训练数据等已开源。

机器之心
产品应用8

Agent大革命!Claude 4连续动编程7小时,刷新世界记录

今天凌晨Anthropic召开开发者大会,发布Claude 4,含Opus 4和Sonnet 4。Opus 4编程智能体连续工作7小时破纪录,Sonnet 4在SWE - bench表现超前沿模型。还新增功能,Claude Code开放,API也有新特性,Sonnet 4免费但有限制。

AIGC开放社区
新闻资讯7

AI查重「杀死」一切!学生93分钟一镜到底证清白

AI时代,教育界信任面临挑战。休斯顿大学学生Leigh Burrell熬夜写的作业被AI检测判为ChatGPT代笔,靠15页证据才洗清冤屈。AI检测工具误判频出,误判率最高达9%,教育界信任正在崩塌。

新智元
推荐文章8

一篇讲透Agent进化飞轮怎么搭:评测→记忆→落地→控制

文章指出多数团队评测、记忆、Self - Improve 拆分做,飞轮难转,原因是环节衔接断链。基于行业研究及实践,提炼评测→记忆→落地→控制四齿飞轮方法论,阐述各环节核心矛盾、建设要点、避坑指南及咬合形成飞轮的方法。

腾讯技术工程