「认知几何学」共找到 742 篇相关文章
世界模型一口气输出小时级视频不跑偏,开源了
Alaya Lab等联合推出的Alaya - EVOKE能生成小时级视频,解决常见问题。它把记忆搬到模型外,改造教师模型,经多轮技术操作,实验成绩佳,给出清晰训练方案,也指出项目边界。
大模型最后一层竟是推理累赘?绕开对齐税,奥数准确率暴涨 22.4%!
Qwen团队、清华和南洋理工研究打破传统认知,揭示‘对齐税’现象。提出Confident Decoding策略,在多架构和评测集实验中表现出色,开销低,挑战‘LLM最后一层最优’常识。
小模型推理极限在哪里?微博开源3B小模型,比肩顶级闭源
微博新开源的VibeThinker - 3B小模型,将特定能力维度性能推向极限。它在数学竞赛、编程等可验证推理基准上表现优异,成绩直逼顶尖大模型。其训练流程层层叠加,还提出参数压缩 - 覆盖假说。
ACL 2026 | Spatial-Agent:地图Agent全新概念转换范式
论文 'Spatial-Agent' 提出地理空间问答应建模为 'concept transformation',引入 GeoFlow Graph 中间表示。它从自然语言问题构建图结构,再映射到工具调用。实验显示其对地图任务有帮助,还指出构建地图类 agent 需稳定数据源等。
软体机器人控制难题获解,比传统方法节能75倍,还能闭眼干活
美国两校研究人员结合生物学与人工智能工程学,用‘神经储备池’技术控制生物混合软手臂,实现稳定追踪、自我感知和低能耗运行,还在多方面展现优势,目前研究处于仿真阶段。
AI时代的人才,我觉得最重要的是这6点特质。
作者结合招聘与创业经历,分享AI时代人才应具备的6点特质:好奇心、靠谱、有事实洁癖、多元化思维、能忍受不确定性、低ego高自驱。强调特质比技能更重要,与学历无关。
AI Spot 学术分享会丨ICLR 2026 深度推理专场
当大模型走向深度推理,ICLR 2026 汇聚全球顶尖成果。OpenMMLab 等联合发起 AI Spot ICLR 2026 学术分享会,5 月 14 日 19 点直播,聚焦模型‘慢思考’,嘉宾将解读四大核心技术。
合成数据≠生成模型:一文读懂合成数据的全新范式
最新研究提出合成数据全新分类框架,突破‘生成模型=合成数据’传统认知,涵盖多种方法。还按应用层次划分场景,指出合成数据面临模型坍塌等挑战,正成新型基础设施。
龙虾爆火之后,AI初创的全球化机会来了吗?|明天见
龙虾爆火,AI初创全球化机会几何?3月26日14:00举办出海沙龙,小影科技、谷歌等实践者分享经验,Leewow等初创团队分享产品实践,还将探讨出海窗口期、门槛等话题。
26.7K 标星!GitHub 高分教程 Learn Claude Code:12 节课带你手搓一个 Cursor!
Learn Claude Code是shareAI - lab开源教学项目,目标是让人理解AI编程Agent工作原理。它有12节课,每节加一个机制,逻辑清晰。配交互式Web平台,文档‘心智模型优先’,还提供后续项目助知识落地。