「优化技术」共找到 3815 篇相关文章
DeepSeek-R2要来了?
DeepSeek-R1发布一周年之际,其存储库更新引用全新「model 1」模型,极可能是R2。HuggingFace发文称R1降低技术、采用、心理三重壁垒。R1以推理优先,改变多项认知,故事仍在继续。
AAAI 2026|AP2O-Coder 让大模型拥有「错题本」,像人类一样按题型高效刷题
在AI辅助Coding技术发展背景下,开源大语言模型生成代码有运行错误。上交博士团队提出AP2O方法,构建AP2O - Coder框架,借鉴人类学习模式,经实验验证能提升模型性能、抑制错误、提高样本效率,还适配通用模型。
超棒Claude官方提示词:Anthropic发布Claude 4.x提示工程最佳实践
Anthropic发布Claude 4.x提示工程最佳实践,这些原则在顶尖大模型中一般通用。它强调精准指令驱动性能,构建记忆与状态管理机制,优化工具调用编排,激发高阶认知与专业输出,重塑代码美学与工程规范。
悲报!Stack Overflow彻底凉了,比18年前上线首月问题数量还少
曾经的程序员问答圣地Stack Overflow凉透了,如今提问数量比18年前上线首月还少。它曾是Google技术搜索默认落点,巅峰时有180多个子站。AI兴起改变开发者习惯,加上自身问题,使其走向衰落。
RDSAI-CLI - 用AI重塑数据库终端CLI体验
阿里云RDS团队在发布「RDS AI助手」后,推出智能终端工具RDSAI-CLI。它融合大语言模型能力,将数据库命令行操作升级为意图式交互。该工具已开源,有基础与高级功能,未来还会持续优化。
当 GPU 成为主角:解锁 AI 集群中那 85% 的闲置 CPU 算力
全球AI算力规模增长,GPU成主角,但GPU满负荷运转时CPU利用率低,传统调度机制无法保障优先级,造成资源浪费。TencentOS如意(RUE)的在离线混部技术改造Linux内核调度体系,高效释放算力。
国产GPU造富狂欢:谁是最大赢家?
2025年12月,摩尔线程和沐曦股份上市引发资本市场狂欢,股价暴涨带来造富效应。国资背景投资方在两家公司上市前占据重要地位,私募大佬葛卫东等也入局。但两企业未盈利,面临技术、竞争等挑战。
上市后的摩尔线程,重心从造芯变成建生态
上市刚满15天的摩尔线程在MDC 2025大会展示全栈技术成果,回应市场关注。其创始人强调生态是GPU行业核心,正构建MUSA生态体系,MUSA架构升级,还揭晓‘花港’架构及两款芯片技术路线。
比传统方法强7倍:Anthropic物理隔离危险知识,重塑大模型安全训练范式
Anthropic团队提出选择性梯度掩码技术(SGTM),在训练阶段将危险知识物理隔离到特定参数并剔除,实现安全性与通用能力更好平衡,抗恢复性是传统方法7倍,还能处理未标记危险数据。
人均「95后」,账上超十亿美金,MiniMax叩响港股大门
国内AI创业公司MiniMax在港交所刊发招股书,上市进入冲刺阶段。它以全模态技术和产品服务全球用户,营收增长快、亏损收窄,M2模型表现亮眼,且团队年轻高效,此次上市意义非凡。