连续自回归」共找到 1305 篇相关文章

算法论文8

NVIDIA港大MIT联合推出Fast-dLLM v2:端到端吞吐量提升2.5倍

回归大语言模型推理效率受限,Fast - dLLM v2 由 NVIDIA、港大、MIT 联合推出。它将预训练 AR 模型适配为能并行解码的 Block - dLLM,用约 1B tokens 微调,端到端吞吐量最高提升 2.5 倍,精度相当。

机器之心
新闻资讯8

突发,OpenAI首颗「辣椒」芯片压倒英伟达!GPT-6干崩CUDA

OpenAI首颗研芯片Jalapeño「墨西哥辣椒」实测成绩亮眼,AI推理性能超英伟达全系,功耗仅为一半。它从设计到流片仅用九个月,得益于GPT - Astra协助。有观点认为CUDA护城河或已死,OpenAI正打造算力版图。

新智元
产品应用8

Claude Code 5亿美元背后的AI工程革命

文章介绍了Claude Code的诞生故事、技术选型、开发流程等。它从听歌小工具变为年入5亿美元产品,90%代码写,开发流程快,还重新设计终端交互。Anthropic团队各环节AI化,也有特殊条件,有些经验可借鉴。

宝玉AI
新闻资讯8

击败PI ,清华系具身公司包揽「具身奥林匹克」三项全球第一,刷新世界纪录!

在Benjie's Olympics赛事中,星动纪元凭借研具身智能模型获三项全球第一,击败具身领域老牌公司PI。该赛事规则严苛,星动纪元在剥橘子、开锁、翻袜子任务中表现出色,此前其在技术研发和场景落地也成果颇丰。

AI科技评论
产品应用8

新一代AI教师是什么样?学而思让它从L2「助手」跃迁至L3「老师」

在AI应用落地成关键的当下,教育成AI融合创新前沿。好未来CTO田密提出「AI教师L1 - L5分级」理论,指出当前AI老师达L2水平,L3正演进。学而思学习机的「小思AI一对一」迈向L3,依托硬件和研大模型,结合优质内容,从可用走向可信。

机器之心
算法论文8

钉钉DeepResearch, 0.008元/1k Token击穿地板价

阿里为7.5亿钉钉用户推出Dingtalk - DeepResearch,解决企业办公AI化痛点。系统采用“三横一纵”架构,有多阶段强化学习等三种解法及DingAutoEvaluator纵向飞轮,实现模型进化、纠错。

CourseAI
算法论文8

大模型Agent的下一阶段:可我进化的AI-Agent

在人工智能飞速发展下,研究者探索让AI我反思改进。本文作者构建我进化AI智能体系统,设计四层渐进式架构,经《卡坦岛》实验,证明我进化能力,不同模型表现有差异,代码级进化潜力惊人。

AINLPer
开源动态7

装完Hermes Agent玩了一圈,我觉得龙虾已死!

Hermes Agent势头正猛,被视为龙虾以来首个真正的竞争对手。它让Agent己做Harness Engineering,己写、用、改Skill,还能我迭代。文章介绍了安装使用方法,对比了与其他项目的差异。

探索AGI
开源动态7

Rex-Omni:用 3B 模型颠覆目标检测

长期目标检测依赖传统坐标回归模型,MLLMs方法存在不足。IDEA研究院提出30亿参数的Rex - Omni多模态大模型,在零样本测试中表现超现有回归模型,还具备丰富语言理解能力,有独特设计和训练流程。

带你学AI
产品应用8

人形机器人放无人机,还能上天入海!有点过于赛博了吧

中国电信TeleAI团队推出具身智能组合,包括首款研人形机器人TeleBot - M和全研空海跨域具身智能体TeleAqua - Bee。其智传网(AI Flow)解决具身智能协同与传输问题,适用于抢险救援等危险场景。

量子位