「3D空间推理」共找到 3992 篇相关文章
谷歌发布 Gemma Scope 2,深化对 LLM 行为的理解
Gemma Scope 2 是谷歌推出的解释 Gemini 3 模型行为的工具,结合稀疏自编码器和转码器,能让研究人员检查模型内部表示。它从多方面扩展了原先的 Gemma Scope,还引入针对聊天机器人的分析工具,已发布权重。
聊聊Anthropic这篇最新研究,我觉得可能是AI意识诞生的前夜。
Anthropic最新研究《A Global Workspace in Language Models》,在Claude神经网络中发现与人类大脑意识通达结构功能高度相似的J空间,这结构自发涌现,研究还证明其对Claude输出有影响,或改变人类对意识的理解。
群核十五年:一家“被AI重新定价”的公司上市了|甲子光年
群核科技15年后在港上市,其以“酷家乐”在家居设计软件领域渗透高。它正从3D工具商迈向空间智能服务商,早期被低估,如今随AI发展,早期投入成为生产力,转型向机器收费。
最新!Demis Hassabis:Agent才刚刚开始,AI下一步是创造虚拟细胞
DeepMind掌门人Demis Hassabis在专访中谈到AGI发展,认为当前技术距AGI可能差一两个大突破,预计2030年左右实现。还探讨了记忆、Agent、推理等问题,提及开源、多模态等情况,展望了生物领域虚拟细胞等。
NextStep-1:一次在图像生成上自回归范式的探索
阶跃星辰团队探索自回归图像生成新路径,推出 NextStep-1。它直接在连续视觉空间自回归生成,架构简洁,实现端到端训练。模型有高保真生成和编辑能力,Benchmark 表现佳,但也面临稳定性等挑战。
横扫八大数学竞赛:清华微软联合提出STAR-PólyaMath,Apex基准超GPT-5.5 13.5%
清华大学与微软亚洲研究院团队提出推理多智能体系统 STAR - PólyaMath,构建探索 - 推理 - 验证框架,解决大模型长程数学推理瓶颈,在八大数学竞赛基准获最优成绩,还可泛化到其他推理场景。
为训推加速!全新FlashQLA注意力算子库开源
自Qwen3-Next发布,GDN成Qwen主力注意力层,随模型规模扩大开销增大。现开源FlashQLA算子库,融合优化GDN Chunked Prefill前反向算子,在NVIDIA Hopper上多场景加速,提升预训练和端侧推理效率。
100万亿Token揭示今年AI趋势!硅谷的这份报告火了
OpenRouter和a16z联合发布《State of AI:An Empirical 100 Trillion Token Study with OpenRouter》,基于100万亿Token分析模型真实使用情况,揭示2025年AI发展趋势,如开源模型崛起、推理模型成新范式等。
DeepSeek在Agent上做了件大事!
昨天DeepSeek发布V3.2正式版,强化Agent能力并融入思考推理,其在Agent评测达开源模型最高水平。文中分析Agent成开源‘心病’的痛点,介绍DeepSeek相关解决策略及成果,还给出使用示例。
今夜无显卡!老黄引爆Rubin时代,6颗芯狂飙5倍算力
CES 2026上,英伟达黄仁勋发布Vera Rubin超算架构,推理性能比Blackwell提升5倍,训练性能提升3.5倍,成本降10倍,已投产,下半年商用。还展示自动驾驶模型等,且无新显卡发布。