「参数化求解器」共找到 1476 篇相关文章
社区供稿丨Ring-2.5-1T,思更深,行更远
今天发布并开源万亿参数思考模型 Ring-2.5-1T,在生成效率、思考深度、长程执行上大幅提升。与其他模型对比,在高难推理和长程任务执行达开源领先。介绍架构优势、手搓案例,也提及不足与未来计划。
社区供稿丨迈向AI4S 2.0,上海AI实验室开源书生万亿科学大模型Intern-S1-Pro
2月4日,上海人工智能实验室开源万亿参数科学多模态大模型Intern - S1 - Pro,为AI4S迈向2.0时代提供开源基座。其核心能力跃升,架构创新,协同通用与科学能力,还构建‘算力 - 算法’基座,高质量开源赋能生态。
不跟英伟达走老路,这家GPU公司的技术架构藏着哪些关键解?
在国产GPU上市黄金窗口期,天数智芯上市后首场发布会引发广泛讨论。其公布架构路线图,2027年前追赶英伟达,之后转向创新架构设计。还提出回归计算本质、提供高质量算力两条架构判断,并展示边端算力产品及应用。
Agent 真正的护城河,正在从工具转向记忆资产
2026年初,Anthropic用Claude Cowork引发AI创业热点,其计划引入知识库获“永久记忆”能力,将Agent Memory探索推到前沿。文章探讨独立Memory层成必需品的原因、工程化记忆系统的能力,还对比模型厂商和第三方中立派路线。
网易云音乐前 CTO 曹偲:代码越来越不重要,好的架构才是软件工程核心
网易云音乐前CTO曹偲推出AI Coding产品Toco AI,旨在将确定性和工程性带入AI Coding。他认为架构决定软件开发上下限,代码会逐渐黑盒化,业务架构更重要且难被AI取代,产品可助力软件开发。
让世界模型推理效率提升70倍:上海AI Lab用“恒算力”破解长时记忆与交互瓶颈
上海AI Lab联合多家机构开源Yume1.5,针对视频生成构建可交互“世界模型”的核心难题,提出时空信道联合建模(TSCM),实现近似恒定计算成本的全局记忆访问,展示了世界模型工程化落地的可行路径。
AI Coding新王登场!MiniMax M2.1拿下多语言编程SOTA
MiniMax发布旗舰级Coding & Agent模型M2.1,在Multi - SWE - bench榜单中以10B激活参数拿下49.4%成绩,超越竞品成SOTA。它解决模型‘偏科’问题,适配开发工具链,实测在多语言编程任务中表现出色。
OpenAI突然开源新模型!99.9%的权重是0,新稀疏性方法代替MoE
OpenAI悄悄开源新模型,0.4B参数且99.9%权重为零,是Circuit Sparsity技术的开源实现。该技术通过约束模型内部连接稀疏性,解决传统稠密Transformer黑箱问题,或让MoE模型走上末路,但目前算力成本极高。
里程碑时刻!首个100B扩散语言模型来了,技术报告揭秘背后细节
蚂蚁集团与高校联合团队推出 LLaDA2.0 系列扩散语言模型,其中 LLaDA2.0 - flash 参数量达 100B。技术报告披露细节,其解决了 dLLM 做大做强难题,性能比肩 AR 模型,为扩散模型工业化带来转机。
DeepInsight x ChatBI:个人Agent助手养成计划
文章围绕将ChatBI打造成个人Agent助手展开,从用户视角拆解使用流程,分析提问、反问澄清、结果验证等环节的困难与解决办法,还提及MCP协议、通义千问3及阿里云百炼服务对Agent开发的助力。