「硬件成本」共找到 1945 篇相关文章
劈柴哥和哈萨比斯亲自站台!谷歌世界模型Project Genie刷屏,幕后团队揭秘60秒不是极限,内存是巨大约束
谷歌发布世界模型原型 Project Genie,用一句话或图就能生成可玩交互的实时虚拟世界,由劈柴哥和哈萨比斯站台。它基于 Genie 3、Nano Banana Pro 和 Gemini 构建,解决了世界模型长期以来的短板,目前处于实验阶段。
多模态大模型中Attention机制暗藏「骗局」,需用一个公式修正丨上大×南开
上海大学曾丹团队研究发现,主流VLM中attention受位置偏置和padding区域异常高attention影响,直接用其进行视觉token剪枝会丢失关键信息。团队用公式对attention去偏,集成到多种剪枝方法,提升了模型性能。
7×24h「全职AI员工」爆火硅谷!退休码农让Mac mini一夜卖爆
由Peter Steinberger开发的开源项目Clawdbot爆火硅谷,它可在Mac mini上运行,能调用多种模型,还能通过聊天APP对话。它解决了主流大模型记忆力痛点,重塑了个人AI超级助手定义,还带火了Mac mini。
100根内存条换一套房!AI疯狂吞噬全球内存,普通人电脑快买不起了
2025年下半年起,AI撞上「内存墙」,2026年或成「内存受限」之年。巨头扫货致内存产能被吸,消费级市场供给枯竭,价格飞涨。内存成AI瓶颈,科技界正从硬件和架构上革命破局。
当顶级视频模型半衰期只有 30 天,fal.ai 为什么收入反而一年增长 60 倍?
在生成式媒体技术发展背景下,fal.ai 作为生成式媒体 infra 公司迅速崛起。它通过统一 API 与云端平台提供多模态模型调用能力,2025 年收入增长 60 倍并完成融资。文章解析其如何构建护城河及对行业发展的判断。
Anthropic创始人盛赞Meta:开启广告基础设施「智能体进化」时代
Meta最新论文揭示基于树状思维链搜索的智能体框架,以“无人驾驶”方式重写广告系统底层内核,将内核开发时间从数周缩至数小时,生产环境性能最高提升17倍,Anthropic创始人高度评价。
深度拆解沐曦MXMACA软件栈功能,算力自主+生态兼容,破解国产GPU落地难题
近日,刚 IPO 的沐曦股份发布 MXMACA 软件栈 3.3.0.X 版本。该软件栈可实现多语言支持、算子自动优化与跨框架平滑适配,能让现有 CUDA 项目近乎‘开箱即用’迁移,还兼容主流 AI 框架,助力国产 GPU 解决落地难题。
求稳的安全IP,安谋科技如何守正出奇?|甲子光年
12月24日,安谋科技推出新一代SPU IP——“山海” S30FP/S30P,构建覆盖芯片底层至应用层的一栈式安全防护体系,有抗物理攻击强等五大亮点,能适配不同场景安全需求,完善产品布局。
给Agent装上“海马体”!上海AILab开源MemVerse,定义多模态记忆新范式
上海人工智能实验室开源MemVerse,这是首个面向智能体的通用多模态记忆框架。它将多模态信息与文本对齐到统一语义空间,首创‘双通路’架构与‘记忆蒸馏’技术,让智能体有终身记忆能力,在多模态任务中表现出色。
中兴发了一篇论文,洞察AI更前沿的探索方向
当大模型参数量冲向万亿级,AI 行业面临瓶颈。中兴通讯发布论文剖析困境,勾勒前沿方向。文中分析了 LLM 现状、架构瓶颈、AGI 争议等,还阐述了改进优化措施及下一代计算范式发展趋势,介绍了中兴的探索实践。