「高价值任务」共找到 4127 篇相关文章
性价比搏击:Grok 4 Fast 推理成本直降 98%
xAI上周五发布旗舰模型轻量化版Grok 4 Fast,推理成本直降98%。它通过强化学习在基准测试表现佳,有原生工具调用能力,采用统一架构,性价比高,或改写大模型竞争规则。
叫板英伟达RTX 5090!GPU初创公司做出13倍路径追踪性能的怪兽显卡
芯片初创公司Bolt Graphics首款GPU模组Zeus 4C,路径追踪性能达RTX 5090的13倍。但它不适合游戏场景,更擅长低功耗高精度图形渲染,不过测试、应用、价格目前都是未知数。
字节跳动&清华大学开源多模态时序大模型ChatTS,可实现时序数据对话与推理
字节跳动与清华合作开源多模态时序大模型ChatTS,可实现时序数据对话与推理。它用合成数据训练,解决了数据稀缺等问题,在评估中表现远超基线模型,未来可拓展至更高阶任务。
宇树机器人上市前再破纪录
IPO前夕,宇树科技放出新一代人形机器人「超人」预告视频,其打破两项世界纪录:0.85米短腿原地起跳2米高,冲刺跑峰值速度超博尔特。该机器人仅研发三月多,后续提升空间大。8月19日宇树将上市。
中移动九天团队MultiPL-MoE:全新Hybrid-MoE架构用于增强通用大模型低资源代码能力
大语言模型在有限计算资源下提升多语言代码能力面临挑战。中国移动九天团队提出 Hybrid MoE 架构 MultiPL - MoE,耦合两层专家选择机制优化,实验证明其在增强低资源代码能力、缓解高资源语言遗忘上有效。
如何为 GPU 提供充足存储:AI 训练中的存储性能与扩展性
文章分析 MLPerf Storage v2.0 测试结果,探讨不同存储系统在 AI 训练中表现。在满足 GPU 利用率阈值下,能支撑更多 GPU 的存储系统扩展性与稳定性更强,还需关注资源利用率。以太网存储方案灵活且成本效益高。
世界模型原生新一代范式!极佳视界斩获全球第一后,GigaBrain-0.5M*再进化
具身世界模型新一代原生范式登场,GigaBrain-0.5M*在多真实机器人任务中数小时零失误。它依托世界模型,创新引入人在回路机制,研发采用四阶段闭环训练流程,优势显著。
年终总结,通用Agent在企业落地,为什么这么难?到底要怎么做?
文章指出通用Agent在企业落地难,原因有模型本身问题、工程化落地难度被低估、安全合规要求高。还介绍金蝶苍穹Agent平台,它嵌入企业管理场景,有业务模板、开放标准和安全保障。
AI 顶尖科学家、前 OpenAI 联创 Ilya Sutskever 的 18 个最新思考
这是前OpenAI首席科学家Ilya Sutskever离开OpenAI后的深度访谈。他分享了对LLM研究、实现ASI、研究品味等思考,指出Scaling时代结束,强调‘情感’价值函数等,还回应了创业公司SSI规划。
出自小米的模块化图像编辑改造:让 AI 学会「搭积木」
小米研究团队发布 Lego-Edit 图片编辑框架,将复杂编辑任务拆成工具集和调度系统,工具集模型各司其职,调度系统指挥操作。采用渐进式训练,性能优、扩展性好,体现协同智能优势。