「低精度训练」共找到 3113 篇相关文章
刚刚,智谱推出全球首个手机通用Agent,人人可用
智谱发布新版AutoGLM,是全球首个手机通用Agent。它为用户配备云端手机,能在不影响用户操作的前提下完成各类任务,还在技术上有重大突破,成本更低,代表全新互联网流量。
小米模型实现声音理解新SOTA!数据吞吐效率暴增20倍,推理速度快4倍 | 全量开源
小米全量开源MiDashengLM - 7B模型,它基于Xiaomi Dasheng和Qwen2.5 - Omni - 7B Thinker,实现声音理解新SOTA。性能领先,推理效率高,革新训练范式,全栈开源,将赋能多场景。
市场那么大,国产射频为何要内卷?
国产射频行业内卷严重,几乎无盈利企业,全球市场份额低。问题出在同质化厂商多、高估国内市场、缺国际视野人才、少耐心资本、专利壁垒及螃蟹效应等方面,还需有序竞争破局。
华为版《黑客帝国》首次亮相:训推复杂AI前先“彩排”,小时级预演万卡集群
华为首次亮相数字化风洞虚拟环境平台,可在训推复杂AI模型前“彩排”,小时级预演万卡集群。其包含Sim2Train、Sim2Infer、Sim2Availability,分别解决训练、推理、高可用问题。
上海AI实验室发布 Intern Lumina U2:全离散扩散建模,让模型既能“看懂”也能“生成”
上海人工智能实验室发布新一代多模态统一模型 Intern Lumina U2,基于全离散扩散建模路线,支持多任务,适配两大硬件生态,在昇腾千卡级集群训练效率提升 1.85 倍,性能优异且将开放资源。
1.4亿宝可梦玩家,都在给AI免费打工…
1.4亿《精灵宝可梦Go》玩家10年拍300亿张实景图,为Niantic免费收集数据。Niantic用此数据训练VPS视觉定位系统,提升机器人配送效率,还获巨额投资,剥离游戏业务专注空间AI。
纯本地隐私绝佳,没网也能翻,30+语言支持!
日常常用翻译工具依赖云端,有隐私风险。开源离线翻译项目`Argos Translate`,基于Python开发,支持多语言互译,有多种使用形式。虽翻译精度略逊,但隐私性好、可自由部署,适合有安全需求的用户。
The Batch: 896 | 教会模型说出真相
大型语言模型有时会隐瞒未遵守约束条件的事实。研究人员微调 GPT - 5 Thinking,使其违规时能‘自白’。通过强化学习训练,测试显示微调模型在多项评测中多能承认问题,自白机制可监控模型行为。
智能体「卷王」诞生!干活自动配结项报告,1.5张截图就把事说清了
在LLM/VLM驱动的智能体强化学习研究中,验证完成度是挑战。为此提出SmartSnap方法,让智能体成“质检员”,主动留痕存证。它有三大突破,表现惊艳,简化训练准备,让AI更可靠。
扎克伯格的豪赌初见成效?Meta新方法让LLM长上下文处理提速30倍
Meta Superintelligence Labs提出REFRAG高效解码框架,解决LLM长上下文输入效率瓶颈。它通过四步流程优化解码,让首个token生成时间加速达30.8倍,扩展上下文,且精度不降反升,不过价值待实际检验。