「小目标注意力模块」共找到 994 篇相关文章
semianalysis 长文 | 关于Meta 砸钱、抢人、领导力、建帐篷、计算、数据和超级智能
Meta在基础模型性能落后,扎克伯格亲自挂帅开启AI军备竞赛。他砸钱收购、挖人、堆算力,建GPU集群,还面临Llama 4失败问题,试图通过一系列举措追赶超级智能。
6.5k星!轻量级多智能体对话编排框架Agent Squad
Agent Squad是轻量级多智能体对话编排框架,有6.5k星。它能管理多AI代理、处理复杂对话,具智能意图分类等特性。新SupervisorAgent可协调多专业代理,还有演示应用及多种使用示例。
刚刚,黄仁勋发长文:AI算力要变成一种「资产」
今天,黄仁勋在X发布长文,宣布NVIDIA与六家大型金融机构合作,推动AI工厂算力成新「可投资基础设施资产类别」,目标动员超5000亿美元第三方资本支持全球AI基建。
红杉、顺为、米哈游等数亿融资,前大疆员工做了款消费级纺织机,目前营收近亿
消费级智能纺织公司浪爪智能获红杉、顺为、米哈游等数亿融资,创始人胡文鑫出身工程师。团队专注消费级纺织 DIY,推出消费级纺织 Station 平台,还在研发纺织 AI Agent,此前产品已获近亿营收。
刚刚,机器人练成了宁次的「白眼」:∞帧画面边看边3D重建我们的世界!
蚂蚁灵波开源的LingBot - Map模型实现无尽流,可看∞帧视频稳定实时3D重建。它打破“既要实时、又要记路、还要省显存”的不可能三角,在多项测试中表现优异,补齐具身智能关键拼图。
头号玩家照进现实!NTU发布世界模型交互新范式,攻克主动操作难题
南洋理工大学MMLab团队推出Hand2World,让AI世界模型能真正互动。它摒弃旧有遮挡误导,用3D手部结构与射线编码解耦手与头运动,实现闭环持续交互,基于单目视频全自动标注,为AR、机器人交互铺路。
上海交大DENG Lab提出「LatentUM」:Unified Model的真正「战场」在视觉推理与世界模型
上海交通大学 DENG Lab 提出的 LatentUM,尝试让统一模型把生成的视觉内容纳入推理闭环。它在多项任务上超越基线,其核心思路是生成与语言共享语义空间的离散 visual semantic tokens,模型含三大关键设计。
还在复制粘贴提示词?Memory+Checkpointing 让你从"每次重头来"到"迭代越来越快"
文章介绍了Claude Code最佳实践地图,它将零散手动探索工程化,把关键模块整理成可导航路线图。核心功能包括三段编排、Subagents、Memory + Checkpointing,还给出不同场景方案及使用方法。
AI失忆症有了新解法,哈佛团队开发海马体仿生技术,要用AI终结人类“遗忘史”
近日,AI初创公司Engramme被曝正与投资者接洽融资约1亿美元,潜在估值达10亿美元。其联合创始人是哈佛教授加布里埃尔·克雷曼,技术基于其实验室成果,自研大记忆模型LMMs,已开放记忆API内测申请。
告别人工干预!KDD Cup 2026 Data Agents 赛道:定义下一代数据智能体能力边界
KDD Cup 2026 发布 Data Agents for Complex Data Analysis 赛道,由香港科技大学(广州)和清华大学联合承办。旨在推动 AI 告别人工干预,具备自主任务分解等能力,还推出 DataAgent - Bench 测试平台,有丰厚奖励,公布关键时间节点。