「大算力芯片」共找到 5945 篇相关文章
Meta亿元天团首个大模型交卷!余家辉宋飏Jason Wei耗时九个月,一雪Llama前耻
Meta超级智能实验室耗时9个月推出原生多模态模型Muse Spark,发布后股价拉升。它让Meta在第三方测评中赶上第一梯队,虽在编程和长时间自主运行有差距,但在多模态理解等方面表现突出,不过也有编程翻车情况。
4 天 20K+ Star!VoltAgent 最新开源力作,让 AI 直接掌握各大网站的设计风格!
VoltAgent团队推出新开源项目awesome-design-md,上线4天20K+ Star。它准备50+现成的`DESIGN.md`,从真实网站提取设计系统,让AI按其生成UI,解决开发者用AI写UI的痛点。
MCP已死,CLI当立!OpenClaw压根没想用它,硅谷大厂正在集体弃用。
近期Perplexity宣布弃用MCP,转而用API和CLI。MCP存在浪费Agent资源、启动易失败、权限管理差等问题。而CLI可组合、可调试、认证现成,MCP成多余中间层。
告别大模型“失忆”!人大开源MemSifter:轻量代理先思考再回忆,搞定长时记忆
中国人民大学团队提出全新LLM记忆管理框架MemSifter,打破长时记忆管理‘精度不够’和‘成本太高’的困局。它将记忆检索‘外包’给轻量级代理模型,采用任务结果导向的RL训练范式,在8个基准测试中超越现有SOTA方案。
让两个大模型「在线吵架」,他们跑通了全网95%科研代码|深势发布Deploy-Master
科学计算领域开源软件多,但多数无法直接运行,制约可用性。Deploy - Master 针对此开发,通过搜索筛选工具、双模型博弈构建,将部署成功率提至 95%以上,为 Agentic Science 提供行动基座。
谷歌DeepMind:AGI不必是巨型模型,拼凑型AI群或率先涌现,管理大规模Agent迫在眉睫
DeepMind最新研究提出,AGI未必以单一巨型模型形式出现,可能由多个次级AGI智能体协作拼凑涌现。为此,团队提出分布式AGI安全框架,包含四层深度防御模型应对新安全挑战。
近500页史上最全扩散模型修炼宝典,宋飏等人一书覆盖三大主流视角
宋飏等人所著《The Principles of Diffusion Models》共460多页,系统梳理扩散模型发展脉络与核心思想,以统一数学框架串联多种视角,是研究者参考资料与初学者入门读物。
CVPR 2026新规:强制披露算力成本,高效率、高透明度论文可获三项认可奖
CVPR2026出台‘计算资源报告表(CRF)’试点计划,要求论文作者报告研究中使用的计算资源,提交报告不影响论文接收决策,展示出色计算效率和透明度的论文可获认可奖项。
Andrej Karpathy最新万字采访:AGI还需10年,RL其实很糟糕,AGI不会导致经济大爆发
Andrej Karpathy在两小时万字采访里阐述AI观点。他认为AGI还需十年,强化学习糟糕,其不会带来经济爆炸式增长。还分享创办Eureka的愿景,想构建“知识斜坡”,让人类在AI时代有更强认知力。
Meta AI大洗牌!超级智能一拆四,小扎押注硅谷华人,LeCun或已出局
8月20日Meta半年内第四次重组AI部门,超级智能实验室一分为四,或弃Llama 4转闭源模型,开源理念动摇。Meta还进行财务和基建“加码”,此次重组或意味着从研究到工程落地的转移。