多平台架构」共找到 6216 篇相关文章

开源动态8

Kimi K2技术报告正式发布:“保姆级”深度解析,一文读懂万亿参数智能体的所有秘密

Kimi K2技术报告发布,Moonshot团队用万亿+参数稀疏MoE架构等打造接近Claude - Opus的通用大模型。围绕训练稳定性等改进,有预训练、架构设计等方面创新,为智能体领域提供可行路径。

AI寒武纪
推荐文章8

辛顿、杨立昆等 AI 先驱都源自信号处理——对话 IEEE 首位华人主席、美国双院院士刘国瑞 | 万有引力

本文是对IEEE首位华人主席刘国瑞的访谈。他分享了科研、创业经历,谈到AI先驱源自信号处理,鼓励年轻人追梦,还探讨了科研模式、合成数据、AI应用及未来生活图景等话题。

AI科技大本营
产品应用8

我在Seko 3.0里敲了个「/」,它把导演调了出来

商汤在WAIC发布Seko 3.0,这是一个AI短剧和漫剧创作平台。它把导演变成可调用的能力,将创作者方法封装成Skill。作者通过实验对比,证实Skill核心在工作纪律,该平台还支持成片制作,且有创作者产业基地。

花叔
开源动态8

Suno最强开源对手来了!ACE Studio和阶跃星辰联合开源了一款音乐模型,20秒即可生成4分钟神曲!

ACE Studio和阶跃星辰联合开源音乐模型ACE - Step,参数量3.5B,结合种技术,支持语言风格音乐生成。20秒可生成4分钟歌曲,比传统模型快15倍,有种功能亮点,还介绍了上手步骤和应用场景。

开源星探
开源动态8

o3绞尽脑汁仅答对40%的题目,开源模型基本乱猜?MMSI-Bench:图空间智能试金石

文章介绍了MMSI - Bench,这是用于评估MLLM图像空间推理能力的VQA基准。它人工构建样本、全面分类任务、采用样真实数据。实验显示MLLM在图像空间推理有短板,还开发自动化错误分析流程助力改进。

量子位
开源动态8

阿里开源Qwen3-Coder-Next,80B参数仅激活3B的MoE顶尖编程助手

阿里开源小型MoE代码模型Qwen3 - Coder - Next,总参数量800亿但仅激活30亿参数,在代码生成等任务表现出色。团队构建训练技术栈解决数据匮乏,模型训练分阶段,领域专家模型能力整合,基准测试性能强劲。

AIGC开放社区
产品应用8

Vidu Q2的参考生视频,是AI视频参党的胜利。

作者分享使用Vidu Q2图参考生视频的体验,认为它是AI视频参党的胜利,是新工作流范式。Q2在一致性、表演能力和风格表现力上大幅进化,价格实惠,还推出APP,图参考生视频未来可期。

数字生命卡兹克
产品应用7

吃灰 AI 眼镜爆改“交警 Copilot”,函数计算AgentRun 实操记录

作者将吃灰的Meta Ray - ban眼镜爆改成“交警Copilot”,介绍了“端 - 管 - 云”协同框架,分享客户端与服务端开发过程。还探讨用Agent架构和FaaS的原因,指出其在应对需求变化、节省成本等方面优势,最后提及项目待优化处。

阿里云开发者
算法论文8

NUS LV Lab新作|FeRA:基于「频域能量」动态路由,打破扩散模型微调的静态瓶颈

在大模型时代,参数高效微调(PEFT)已成为迁移大规模扩散模型至下游任务的标准范式。但现有微调方法采用「静态」策略,忽略扩散生成过程内在规律。新加坡国立大学LV Lab等机构提出FeRA框架,通过频域能量动态路由,实现高效微调。

机器之心
算法论文8

缺数据也能拿SOTA?清华&上海AI Lab破解机器人RL两大瓶颈

现有机器人视觉 - 语言 - 动作(VLA)模型训练范式存在数据采集成本高、泛化能力不足等问题。清华和上海AI Lab团队提出SimpleVLA-RL,解决了VLA模型训练的核心瓶颈,在基准测试中实现SoTA性能。

量子位