新架构」共找到 4983 篇相关文章

产品应用8

Qwen3.8-Flash:全新架构,更强更稳更划算

本文介绍了 Qwen3.8-Flash 多模态 MoE 模型,它原生支持 262,144 token 上下文。该模型在 Attention、Residual、Embedding 与 Optimization 四个方面系统升级,降低训练与推理成本,即将上线千问 AI 平台。还发布了 Qwen3.8-Flash-Next 开源权重。

千问大模型
推荐文章7

扩散架构 or「NoThinking」,AI 对话的「1Hz 壁垒」如何突破?

当红通用人形机器人公司 1X 的 AI 副总裁 Eric Jang 提出「智能频谱」概念,阐述当前 AI 面临的「1Hz 壁垒」及实现「Ultra Instinct」能力的先决条件。不同推理方案有望解决部分问题,但通用智能体仍有瓶颈。

机器之心
新闻资讯8

从「悟道」到「悟界」,智源走进大模型的时代

在2025智源大会上,智源研究院院长王仲远表示大模型技术演进未到终点。会上推出「悟界」系列大模型,包含Emu3、见微Brainμ等,推动AI从数字走向物理世界。还介绍了具身智能成果,且与企业合作打造生态。

AI科技评论
算法论文8

1/15成本,实现AI水印SOTA | 南洋理工大学&A*STAR

给AI生成作品打水印成行业共识,但传统方法有短板。南洋理工大学等机构研究人员提出局部鲁棒图像水印方法MaskMark,成本仅为Meta模型WAM的1/15,在多任务中表现优异。

量子位
算法论文8

Reasoning突破:SoftCoT++如何让LLM‘多想几条路’?

LLM推理依赖‘思维链’,传统方法在离散token空间生成步骤有信息丢失、多样性不足问题。SoftCoT++在连续空间生成‘软思维’,拆分‘思考’与‘推理’,用专用初始token和对比学习,实验中全面超越传统方法。

深度学习自然语言处理
新闻资讯8

刚刚,Gemini 2.5 Pro升级,成编程模型

Google DeepMind发布Gemini 2.5 Pro (I/O edition),编程能力大幅提升,在编程排行榜超Claude 3.7 Sonnet。用户用一个提示词或草图+描述就能构建应用,谷歌大佬站台,网友实测效果佳。

机器之心
算法论文8

NovaSilicon发表论文:造芯的瓶颈不在工具,而在组织

NovaSilicon发表论文探讨超级智能在芯片领域的运用。随着芯片复杂度提升,传统EDA方法遇瓶颈,论文提出将芯片设计超级智能建模为AI组织,利用LLM等技术,重塑芯片设计行业,实现产业链智能化升级。

五源资本 5Y Capital
开源动态7

深度拆解 DeepSeek Harness 架构:AGI 的自进化,终于有了「后悔药」

8月13日,DeepSeek开放DeepSeek Harness v0.1开发者预览版,在Github获4.5万星。它提出“一切皆插件”概念,核心组件可插拔。还联合北大提出Cordis框架,解决组件插拔问题,但面临价格与组件膨胀挑战。

AI科技评论
算法论文8

揭秘 | 桥梁缺陷检测突破:模型压缩42%,精度几乎不掉

全国公路桥梁超百万座,传统人工巡检效率低且有安全风险,现有深度学习检测模型体积大、计算量高。研究团队提出LBSD - YOLO网络,通过创实现轻量化,实验显示模型瘦身但性能不减,有重要应用价值。

机器学习AI算法工程
产品应用7

人形之外,擎羽把“身体”变成具身智能的变量

机器人身体正成为具身智能里被低估的变量。擎羽科技不走人形路线,带来三款仿生柔性机器人及跨本体基础模型Fi0,提出柔性具身智能概念,让智能摆脱对单一身体的依赖。

量子位