「主动感知」共找到 488 篇相关文章
Scaling时代终结了,Ilya Sutskever刚刚宣布
Ilya Sutskever 在访谈中称「Scaling 时代已终结」,指出当前模型存在能力参差不齐、泛化不足的问题。他认为人类情绪类似价值函数,人类学习效率高。未来 AI 发展将进入研究时代,他还分享了 SSI 战略及对 AI 对齐等问题的看法。
NeurIPS 25 | 中大&UC Merced等开源RAPID Hand,重新定义多指灵巧手数据采集
来自多机构研究者联合提出全新开源高自由度灵巧手平台 RAPID Hand。它能解决硬件瓶颈问题,实现稳定、高质量数据采集。其软硬协同优化,在操作表现与稳定性上优于现有方法,还具备低成本等优势。
Meta超级智能实验室首篇论文:重新定义RAG
Meta超级智能实验室首篇论文提出REFRAG框架,重新定义RAG。它通过“压缩、感知、扩展”流程优化LLM处理外部知识方式,最高将首字生成延迟加速30倍,且性能无损。
OmniHuman-1.5:让数字人拥有“思考”的视频生成新范式
现有视频数字人模型难捕捉角色本质,字节提出 OmniHuman - 1.5 框架。其核心创新是用 MLLM 提供语义引导、提出多模态 DiT 架构和伪末帧设计,使模型融合多模态信号,生成高质量角色动画。
八爪鱼微电子:打造感算一体的智能识别生态
八爪鱼微电子成立于2019年,是国内智能门锁芯片与模组领域领先企业。它构建‘感算一体’底层技术体系,还通过标准共建、创新平台构建等推进生态建设,欲以技术与生态驱动行业创新。
清华-腾讯联手:音频 - 视觉多模态任务统一框架
Crab是人大、清华和腾讯合作论文提出的模型,目标是高效一统多模态场景理解任务。它解决了音频 - 视觉理解模型任务干扰、合作显式化不足等难点,通过构建数据集、设计结构和统一架构实现多任务合作。
1M 上下文时代太费 Token,告诉你我的 Coding Agent 省钱方法
当下GPT-5.5等模型原生支持1M上下文,虽能支撑长任务,但易被噪音干扰且费Token。作者以Claude Code为例,介绍做好会话管理的多种省钱方法,如根据任务选择会话策略、利用rewind功能等。
刚刚,“云计算一哥”版龙虾发布,奥特曼打着官司也要云站台
亚马逊云科技发布Amazon Quick,可连接本地文件等,打通生态,还是主动的Agent。奥特曼虽打官司仍云站台,OpenAI与亚马逊云深度合作。此外,Amazon Connect扩展成四个AI解决方案,发布会强调Agent是新企业操作系统。
壁垒在上下文,不在模型
特赞科技发布企业级智能体系统 GEA,推出发散推理模型和企业上下文系统。指出模型能力易复制,企业上下文才是壁垒。GEA 架构分四层,有独特的推理和执行模式,已在多家企业部署。
BellSoft 发布 Java 加固镜像
BellSoft 在 KubeCon 2025 大会发布新的“加固镜像”产品,集 Java 运行时优化、操作系统加固与主动 CVE 修复于一体,可减少已知漏洞、降低资源消耗,还提供 SBOM 满足合规需求。