「连续思维机」共找到 534 篇相关文章
机器人需要一个「思考系统」:τ0-VLA让具身智能迈向长程任务时代
2026 WAIC落幕,具身智能成焦点。当前VLA模型在长程任务中有局限,上海创智学院和智元机器人联合发布τ(0)-VLA,提出分层架构和新推理机制,用大量真机数据训练,在长程任务表现出色。
人手数据,如何重塑机器人基础模型?专访 LaST-HD 一作刘家铭
本文是对 LaST-HD 一作刘家铭的专访。围绕数据路线之争,刘家铭分享交付背后的技术问题,也谈了对具身领域模型与数据发展方向的判断。他认为 Human Data 与真机数据非替代关系,VLA 和世界模型可共存。
刚刚,DeepSeek V4 Pro正式版发布!
周三晚间,DeepSeek 突然发布 V4 Pro 大语言模型正式版,命名为 DeepSeek - V4 - Pro - 0813,官方未调升 API 使用价格。有用户称调用的 V4 Pro 思维链风格有变,跑分显示其 Agent 评测表现可媲美顶级模型,还撞车了马斯克的 Grok 4.6。
OpenAI Astra被曝引入「循环深度」能力飙升!安全专家坐不住了
OpenAI 最强新模型 Astra 或即将发布,它是首个达「关键级」网络安全能力门槛的模型,在测试中表现优异。《The Information》爆料其用「循环深度」技术,能力提升但引发安全专家担忧,该技术可使模型内部计算增多,思维链监控或失效。
9B“小”模型干了票“大”的:性能超8倍参数模型,拿下23项SOTA | 智谱开源
智谱发布并开源仅9B大小的模型GLM-4.1V-9B-Thinking,在28项评测中拿下23个SOTA,成10B级别最佳VLM模型。它引入思维链推理机制,通过课程采样强化学习提升能力,还获10亿投资。
涌现之谜:AI如何像人一样思考与表达?
文章探讨AI如何像人一样思考与表达。早期自然语言处理受通用语法理论影响,但面对真实语言复杂性存在困难。人类经历第一次认知革命实现思维转变,AI也需足够大规模才能涌现复杂能力,“大”或是智能第一性原理。
具身智能的「Z 世代」,来了
文章与三位具身智能领域的Z世代年轻人对话,他们有不同背景和经历。谭恒楷研究机器人,提出创新模型和算法;吴铭东专注真机强化学习;王乾旭研究蒸馏特征场。他们对AI有独特认知,展现出年轻人的冲劲和思考。
300个AI员工,跑满4000步不崩,Kimi新一代模型K2.6来了
月之暗面开源发布 Kimi K2.6 模型,在通用智能体、代码编写和视觉理解等综合能力上全面跃升。它在多项测试成绩领先,能连续工作13小时,还在全栈开发、多智能体协作等方面有出色表现。
【博客转载】NVIDIA Docker CUDA Compatibility /Nsight Compute In Docker
本文围绕NVIDIA Docker CUDA兼容性及Nsight Compute展开。指出使用NVIDIA NGC CUDA Docker容器时,要保证宿主机CUDA驱动与容器内运行时库版本一致,否则会有问题。还介绍了在Docker中安装和使用Nsight Compute的方法及示例。
刚刚!北大校友Lilian Weng最新博客来了:Why We Think
北大校友Lilian Weng更新博客《Why We Think》,回顾利用测试时计算的研究进展,探讨让模型“思考更久”的方法。文中介绍了思维链、潜变量建模等策略,还提及多种提升生成质量的策略,如并行采样与序列修订,以及强化学习提升推理能力等内容。