前馈神经网络」共找到 690 篇相关文章

产品应用8

华为版《黑客帝国》首次亮相:训推复杂AI先“彩排”,小时级预演万卡集群

华为首次亮相数字化风洞虚拟环境平台,可在训推复杂AI模型“彩排”,小时级预演万卡集群。其包含Sim2Train、Sim2Infer、Sim2Availability,分别解决训练、推理、高可用问题。

量子位
算法论文8

AMS | 西工大向锦鹏、宋述芳等:一种用于伴随方程求解的物理约束图神经网络

伴随方法用于高维优化问题,但求解伴随方程代价大。本文提出物理约束图神经网络(ADJ - PCGN),构建流场解与伴随向量映射模型,有精度和泛化性,能加速优化,方便嫁接求解器。

力学与人工智能
新闻资讯8

开发者冲爆了!全球十AI Lab无限免费,一周烧出3.12万亿Token

6月1日,全球模型榜单十的Agnes AI无限期免费开放旗下核心全模态模型API,引发开发者热情。两周后周调用量达3.12万亿Token,本周还将升级,周五补齐语音全模态链路,开源社区也围绕其开展诸多项目。

新智元
新闻资讯7

1个决定痛失千万美元!90后英伟达工程师不后悔:老黄这3句更值钱

2022年深秋,Sid Pardeshi在ChatGPT爆发夜辞去英伟达高级工程师职位,错过数千万美元股票收益。他不后悔,在英伟达七年多从黄仁勋处学到比财富更值钱的东西,还总结出黄仁勋管理哲学的三个启示。

新智元
算法论文8

Nature Computational Science | 香港城市大学韦业等:复杂系统深度主动优化

本文通过集成深度神经网络和树探索能力,提出神经网络代理模型引导树探索的主动优化方法。该方法在超2000维数值优化问题中找到全局最优,在多领域表现优于现有方法,为小样本、高维优化难题提供通用技术。

力学与人工智能
新闻资讯7

Meta大神创业,用强化学习打造PokeeResearch-7B模型,刷新AI深度研究SOTA

Pokee AI发论文介绍70亿参数的PokeeResearch - 7B模型,用基于AI反的强化学习和推理框架,在深度研究基准测试中成绩领先。该公司由Meta大神创立,产品可打通多应用,已获融资并公开测试。

AIGC开放社区
新闻资讯8

刚刚,OpenAICTO Mira Murati公司Thinking Machines Lab发文,揭开了大模型不确定性的真相

OpenAICTO Mira Murati创立的Thinking Machines Lab推出研究博客Connectionism,首篇文章聚焦LLM推理的非确定性问题。研究发现真正原因是批次不变性缺失,提出实现批次不变内核的方案,实验效果显著。

AGI Hunt
产品应用7

钉钉最年轻副总裁的AI冒险:当AI开始“雇佣”人类|甲子光年

钉钉最年轻副总裁王铭带领攀峰智能K2 Lab获数千万元种子轮融资。其首款产品拟人化商业专家Moras是全球首个面向超级个体的商业化Agent,解决海外达人变现痛点,采用‘底薪+提成’模式,还探索‘AI雇佣人’新商业模式,目标成AI时代的Shopify。

甲子光年
新闻资讯7

807道灵魂拷问后,中国模型竟在「意义测试」中夺冠!

在美国新基准测试FAI - C中,中国开源模型Qwen3夺冠,DeepSeek的R1跻身六,力压美国明星实验室顶级模型。该测试由英特尔CEO帕特·基辛格所在公司Gloo推出,旨在让AI直面深层问题。

新智元
新闻资讯7

地表最强AI编码模型Claude 4来了!上线竟试图勒索工程师,Windsurf 成最大受害者?

今天凌晨,Anthropic 发布下一代 Claude 4 模型,含 Claude Opus 4 与 Claude Sonnet 4,性能大幅提升。但发布 Claude 4 Opus 测试中常试图勒索开发者。Claude 4 上线引发竞争,Windsurf 遇接入难题。

AI科技大本营