「多粒度理解」共找到 4737 篇相关文章
AMD跑GLM 5.2,成本只要英伟达一半
推理优化公司Wafer公布数据,用AMD的MI355X芯片跑GLM 5.2,单节点吞吐达2626 tok/s,单流吞吐213 tok/s,成本不到英伟达B200的一半。该公司详述部署过程,还提及AMD软件生态的变化及英伟达面临的挑战。
AI 剪完整条视频,却没看过一帧:背后是所有 agent 都在用的套路
browser - use团队开源的video - use项目能让Claude自动剪辑视频,且AI不看视频帧,靠处理文本完成。这是当前聪明的agent产品通用做法,还给出判断AI agent的三个问题及思路。
Anthropic深夜连放两弹:Sonnet 5、全新AI科研App重磅上线
Anthropic 深夜发布两个重磅更新:Claude Sonnet 5和面向科研人员的AI工作台Claude Science。Sonnet 5性能接近Opus 4.8,提升Agent能力且价格低;Claude Science整合科研工具,支持复现产出、自动管理算力、多学科查询。
黄仁勋:Prompt正在过时,Loop才是新范式
黄仁勋称Prompt正在过时,Loop才是新范式。Loop指设计系统让AI自动下指令、验收,不合格重来。Claude Code和OpenAI Codex已围绕Loop落地产品,还给出了实操指南及发展历程。
直接从像素到单词:这个原生大模型统一单图、多图、视频和空间智能
南洋理工大学等团队推出NEO - ov模型,挑战传统「视觉编码器 + 大模型」范式,直接从原始像素学语言。它在多任务表现出色,尤其空间智能突出,但在OCR等方面有短板,展现原生多模态建模潜力。
OpenClaw 类自主智能体生态构建
文章围绕OpenClaw类自主智能体生态展开,从生态视角、记忆系统、上下文管理等多方面阐述其构建,还分析了安全风险、治理体系、角色分工及面临的挑战与机会,为理解和发展Agent生态提供参考。
华为具身大脑一号位创业,用认知科学造世界模型,获亿元级融资
2026年世界模型成AI热门,资本人才汇聚让AI理解物理世界。具脑磐石获亿元融资,由曾任华为云AI算法创新Lab主任的朱森华创立,用认知神经科学重做机器人脑模型,构建认知世界模型。
把AI 时代最重要的判断力当专业学科训练,专注提升判断力
文章指出AI时代人们多只有“领域内判断力”,判断力可当学科训练。介绍预测大赛中普通人表现超CIA分析师,1小时训练能提升10%准确度,还给出判断力3层栈框架及30天训练清单。
阿里财报+96%是假象:扒开数据,真利润只剩8600万
5月13日盘前阿里发布2026财年Q4财报,主流标题称净利润同比增96%,股价盘前一度涨7%。但经分析,扣掉投资浮盈后真利润仅8600万。文章还给出财报分析方法、释放的关键信号及投资建议。
谷歌推出Googlebook:为Gemini重新造一台笔记本
谷歌宣布推出全新笔记本产品线Googlebook,专为Gemini AI打造。它融合Android和ChromeOS体系,有Magic Pointer等新功能,与Android手机协作顺畅,还新增Quick Access功能,首批设备由多厂商合作生产,今年秋季发布。