「动态参数生成」共找到 3119 篇相关文章
沉寂一个月,openPangu性能飙升8%!华为1B开源模型来了
华为发布专为昇腾端侧硬件打造的openPangu Embedded - 1B模型,仅10亿参数却性能卓越。它运用多阶段训练和优化,在权威基准表现亮眼,V1.1平均分较上月跃升超8%,还介绍了背后技术。
英伟达韩松团队新作:具有后神经架构搜索的高效语言模型
英伟达韩松团队推出基于后神经架构搜索的高效语言模型Jet - Nemotron,在基准测试中表现出色,准确率与Qwen3等相当甚至更优,生成吞吐量大幅加速。模型构建经多步骤优化,代码和预训练模型将开源。
构建可靠AI Agent:从提示词、工作流到知识库的实战指南
本文阐述如何构建可靠、高效且可落地的AI Agent应用。随着LLM和工具调用标准化,开发核心竞争力转向提示词工程、工作流设计和知识库构建。还介绍各部分要点及安全策略,给出确定AI项目的方法。
小红书团队开源dots.ocr:文档解析新王者,性能比肩Gemini!
文档解析领域处理多语言复杂文档需高效能力,传统OCR工具存在不足。小红书HiLab开源多语言文档解析模型dots.ocr,基于1.7B参数视觉语言模型,性能达SOTA,单页PDF处理快,公式识别媲美大模型。
4000万样本炼出AI读心术,刷新七榜SOTA,最强「人类偏好感应器」开源
Skywork-Reward-V2全新发布,构建超高质量千万级人类偏好样本,刷新七大评测基准SOTA。8款模型覆盖6亿至80亿参数,小体积也能媲美大模型性能。团队引入多样大规模真实人类偏好数据,提升数据规模与质量。
DeepSeek-R2为什么还没发?
全网期待的DeepSeek - R2再次被曝推迟。The Information称因CEO不满其表现,且可能因缺英伟达H20芯片致研发慢。回顾其“难产”过程,网友看法不一,有人认为延迟值得,有人推测要等V4。
微软 CTO 在 Rust Nation UK 大会上详解成功经验、挑战及对 Rust 编程语言的承诺
微软Azure首席技术官Mark Russinovich在Rust Nation UK大会探讨推动Rust采用的因素,展示微软产品中Rust应用成果,介绍用生成式AI加速C/C++向Rust迁移的努力,还提及开发者反馈及微软对Rust的承诺。
NVIDIA发布最强开源模型,效果和速度全面超越DeepSeek R1
NVIDIA推出Llama - Nemotron系列开源模型,有LN - Nano、LN - Super、LN - Ultra三款。旗舰款LN - Ultra在权威测评中碾压DeepSeek - R1等,运行效率还更高。有“动态推理开关”功能,代码数据全公开,或引发AI推理效率革命。
智能体时代EDA工具革新,比昂芯科技专注AI驱动电路仿真及Chiplets设计
近期,AI+芯片设计生成成全球资本热门赛道。比昂芯科技早在2024年就启动AI在EDA领域的底层技术探索,形成AI原生EDA完整技术闭环。其研发总监吴晨博士在IDAS 2026分享实践,公司还有四大核心产品及服务。
实测 MiniMax H3:开源“斩杀线”蔓延到视频模型圈
本文实测 MiniMax H3 视频模型,它 8 月 3 日开源,成本低至 0.5 元/秒,在编辑榜成绩佳。它定位全模态生成,能多素材输入。实测效果好,价格约为 Seedance 2.5 的三分之一,还支持原生剪辑,适配多芯片与工具。