「低精度训练」共找到 3119 篇相关文章
上帝视角!DeepMind提前5天锁定Melissa,强度预报不再靠天
飓风Melissa来临前,DeepMind算法提前5天预言其强度变化。该模型用两类数据训练,能生成多种未来场景,在路径和强度预测上优于传统模型,已被NHC投入实战,但AI不能理解灾难,人类仍需做决策。
我花12小时深度实测,阿里Qwen-3 Coder被Kimi K2“吊打”!
作者花12小时在真实项目中实测阿里Qwen - 3 Coder和Kimi K2。结果显示,Kimi K2在任务成功率、指令遵循、Bug修复、代码重构等方面全面领先,成本还更低,作者更推荐Kimi K2用于代码开发。
“10x Cursor”开发体验, Claude Code 如何带来 AI Coding 的 L4 时刻?|Best Ideas
文章聚焦 Claude Code,探讨其在 AI Coding 领域的表现。开发者因成本低、效率高、异步开发等优势迁移至此。虽其 CLI 形态爆火,但 GUI 才是未来。Claude Code 达 L4 级别,也指出当前 AI coding 产品不足与未来机会。
32B 稠密模型推理能力超越 R1?中国秘密 AI 团队发布推理小模型 AM-Thinking-v1
2025年,国内神秘A - M - team在Hugging Face开源32B推理模型AM - Thinking - v1。它在多推理评测中击败DeepSeek - R1,与超大规模模型成绩相当。团队靠后训练方案挖掘32B模型潜力,探索小体量实现大能力路径。
为什么AI大厂的人,都跑去做生命科学了?
越来越多AI人才投身生命科学,创办数十亿美元估值公司。这是因训练通用模型门槛高,而生命科学技术可迁移、产业愿付费且有成功先例。新一代公司AI位置、融资、技术目标有变化,但仍面临数据和临床验证问题。
Anthropic逼急谷歌!布林下场亲自督战,组「追杀队」围剿Claude
谷歌联合创始人布林亲自督战,组建攻坚队「追杀」Anthropic,欲夺回编程能力差距。Claude在编程领域锋芒正劲,谷歌AI编码占比仅50%,而Anthropic已达100%。攻坚队聚焦长期写代码任务,策略转向优先训练内部代码模型。
估值1亿的"死了么"APP有多好抄?5分钟AI就能复刻,去年有人一下午做出原型
‘死了么’APP 更名 Demumu,曾登热搜与付费软件榜首。此前一数据分析师用 AI 5 分钟复刻海外版,感叹技术不值钱。该 APP 由 3 名 95 后开发,初始成本低,现估值近 1 亿,还涌现诸多类似免费 APP。
商汤科技与南洋理工大开源空间智能多模态SOTA模型
商汤科技与南洋理工大学构建800万量级三维空间数据集,训练出开源SOTA多模态基础模型SenseNova - SI系列。该系列模型在多个权威测试中表现出色,部分超越GPT - 5,还展现出泛化等能力,且能赋能具身智能。
制造企业如何实现 AI 产品经理“能力复制”?|极客时间 AI 人才培养实践
在数智化转型中,企业 AI 培训常难以转化业务价值。极客时间为某制造企业定制 AI 产品经理 OMO 训练营,以业务场景为导向,采用三阶段闭环培养模式,课程覆盖全链路,助企业培养人才、建立培养体系。
沉寂一个月,openPangu性能飙升8%!华为1B开源模型来了
华为发布专为昇腾端侧硬件打造的openPangu Embedded - 1B模型,仅10亿参数却性能卓越。它运用多阶段训练和优化,在权威基准表现亮眼,V1.1平均分较上月跃升超8%,还介绍了背后技术。