参数共享」共找到 827 篇相关文章

产品应用8

不拼参数,拼认知:工业AI的边界与深水区 | 甲子光年

如今AI渗透工业各环节,形成“大小协同”格局,但面临场景复杂、数据孤岛等挑战。西门子凭借深厚积累构建工业体系,其Industrial Copilot等产品落地中国,还自研基础模型突破瓶颈,围绕‘AI for Real’理念布局。

甲子光年
产品应用8

把PLC仿真搬进浏览器,小参数模型也能实现高工程通过率

上海交通大学联合Sema研究团队推出SemaPLC,将AI Agent与PLC工程工具链连接,让自然语言需求转化为可编译、验证、仿真的控制程序。它是面向全流程的智能工作台,实验效果优于业界方案。

量子位
新闻资讯7

DeepSeek V4真要来了?万亿参数模型匿名开测,免费跑龙虾

推特博主曾‘预示’DeepSeek V4要来,后澄清不确定。今OpenRouter上新‘Hunter Alpha’和‘Healer Alpha’两神秘模型,免费且可跑‘龙虾’,社区对其归属猜测不断,答案待官方揭晓。

机器之心
产品应用8

参数破万亿!阿里Qwen3-Max-Thinking发布,编程能力“踢馆”Gemini与Claude

阿里发布总参数超万亿的Qwen3 - Max - Thinking,预训练数据规模达36T Tokens。在多项权威测试中表现优异,能与顶级闭源模型竞争。引入两项核心创新,千问App等已上新,网友认可其能力与更新速度。

AI前线
算法论文8

EMNLP2025 | 探究大语言模型的语言共享神经元提升低资源语言能力

论文提出BridgeX - ICL方法提升LLM低资源语言性能,通过三步实现优化。构建两类探测数据解决传统问题,识别重叠神经元,用HSIC选最优桥梁语言,在多任务实验验证其有效,揭示多语言机制规律。

深度学习自然语言处理
开源动态8

碾压DeepSeek V3!开源AI Agent专属模型,1万亿参数、工具使用能力超强

国内大模型平台月之暗面开源了模型Kimi - K2,这是混合专家模型,总参数1万亿。它针对AI Agent优化,工具使用能力强。测试显示其性能碾压DeepSeek V3等模型,训练流程还有独特技术创新。

AIGC开放社区
开源动态8

12项世界第一!国产基模一战封神,11亿参数逆袭70亿大魔王

蚂蚁灵波的LingBot-Depth 2.0空间感知模型,在测试中拿下12个世界第一,解决了玻璃、细小物体等行业难题。它还与奥比中光达成合作落地商业应用。其核心预训练基模LingBot-Vision被开源,有望加速具身智能生态发展。

新智元
开源动态8

企业级OpenClaw最强拍档来了!万亿参数的国产多模态大模型,刚刚开源发布

YuanLab.ai团队开源源Yuan3.0 Ultra多模态基础大模型,是万亿级开源多模态大模型之一。它优化训练效率,在多任务表现突出,为企业Agent AI提供支撑,还提出新算法和训练策略,全面开源推动落地。

量子位
产品应用8

把20亿参数装进胸针?高通补齐了个人AI生态的最后一块拼图

在MWC巴塞罗那展会上,人们渴望专属AI智能体。高通认为AI须进驻微型载体,推出骁龙可穿戴平台至尊版,将AI运算能力延伸到微型设备,其还构建以用户为中心的生态,让私人助理融入生活。

量子位
算法论文8

普林斯顿大学等Nature揭秘:人类大脑与大语言模型共享同一套语言处理时钟

普林斯顿大学等机构研究发现,大语言模型层级计算序列精确映射人类大脑处理语言的毫秒级时间动态,其与人类大脑理解语言的先后顺序高度一致,为理解大脑和开发神经网络架构开辟途径。

AIGC开放社区