新架构」共找到 4965 篇相关文章

新闻资讯7

突发!林俊旸被曝创业:AI Lab估值20亿美元

自3月初离开阿里Qwen团队后,林俊旸动向曝光。外媒消息称他正为创立的AI Lab筹集数亿美元资金,本轮融资后估值或达20亿美元,高榕创投与红杉资本已接洽投资,他还招募了相关成员。

机器之心
开源动态8

20000 GPU·h砸出 106 个SOTA模型架构:AI 科研进入“自我加速”时代

模型架构发现领域迎来突破,ASI - ARCH超级智能体无需人类预设搜索空间,完成科研闭环。经20000 GPU·h、1773次实验,发现106个超越人类SOTA的线性注意力架构,且已开源。

PaperAgent
算法论文8

纯靠“脑补”图像,大模型推理准确率狂飙80%丨剑桥谷歌研究

剑桥、伦敦大学学院和谷歌团队推出基于强化学习的视觉规划(VPRL)范式,纯靠图像推理。框架利用GRPO后训练,准确率达80%,超文本推理至少40%,代码已开源。

量子位
开源动态7

Clawdbot再次更名:名OpenClaw,官宣支持Kimi K2.5和小米MiMo

两个月前Peter Steinberger搭建的项目,最初叫WhatsApp Relay,现获超10万GitHub星标、单周200万访问者。1月29日正式更名为OpenClaw,它是开源AI助手平台,此次发布渠道、支持模型等。

AI寒武纪
新闻资讯8

重磅!OpenAI联合苹果传奇设计大佬Jony Ive官宣公司「io」:剑指全AI交互硬件

半小时前OpenAI官网宣布,苹果前首席设计官Jony Ive与OpenAI CEO Sam Altman联手打造公司「io」,旨在革与AI交互方式。两年前双方已开始合作,如今「io」并入OpenAI,Jony Ive主导设计。

AI寒武纪
算法论文8

Meta突破!跨模态生成告别噪声:流匹配实现任意模态无缝流转

Meta与约翰霍普金斯大学联合推出CrossFlow框架,实现跨模态生成突破。它基于流匹配提出范式,无需依赖噪声分布等,在多任务上媲美或超最优算法,训练成本低、速度快,还能适配多任务。

机器之心
产品应用7

图生视频玩法刷爆外网:图上画两笔就能动起来,终于告别文本提示

Higgsfield AI 是专注 AI 视频生成的初创公司,近期发布 Draw-to-Video 和 Product-to-Video 功能,前者画图形元素就能生成视频,后者可拖拽生成广告视频。它还常上功能、集成热门模型,官网功能模板丰富。

机器之心
产品应用8

抛弃“级联”架构!快手OneRec用大模型重构推荐系统,服务成本降至1/10

传统级联式推荐架构有瓶颈,快手用OneRec重构推荐链路,服务成本降至1/10。文中介绍OneRec架构、Tokenizer方案、强化学习奖励设计,还提及优化及多模态联合训练方向。

InfoQ
推荐文章7

中学生就能看懂:从零开始理解LLM内部原理【十三】|GPT 架构如何工作 ?

本文是对GPT架构工作原理的解读。介绍了GPT与Transformer的关系,阐述其从输入文本到预测下一词概率的流水线,详述训练和推理流程,还提及GPT架构进化的混合专家(MoE)模型。

AI大模型应用实践
推荐文章8

企业级 Agent 多智能体架构与选型指南 -- 来自1000+行业应用实践积累

本文基于超1000+智能体应用实践经验,介绍企业级Agent多智能体架构。强调单智能体优先,介绍AgentScope支持的多智能体模式,对比工作流与对话模式,给出架构选型指南,还提及Spring AI Alibaba Graph为多智能体提供的能力。

阿里云开发者