「空间理解能力」共找到 4047 篇相关文章
马斯克吹牛了吗?Grok 4第一波实测出炉:既能完虐o3,也菜到数不清6根手指
马斯克称Grok在各学科达博士后水平,激起网友兴趣。博主测试显示Grok 4在多项测试中完胜o3,网友还用它写游戏、让概念可视化。不过Grok 4也有翻车表现,马斯克称其仍有改进空间。
2025 年 AI 编程趋势:智能体 10 倍生产率放大下的“粪围”蔓延
文章指出 2025 年是体系化跃迁起点,AI 编程工具不断升级。AI 代理能力超代码补全,编程从‘代码直生’转向‘计划先行’,自动验证增强,还有异步化、团队协作等趋势。但 AI 重构有问题,还会放大技术债。
Meta全开源HumanCLAW:基础模型正进入具身智能的决策层
过去基础模型主要理解和描述物理世界,如今开始进入机器人控制栈。Meta等提出HumanCLAW,将高层行动与低层运动控制分开。评测显示当前模型在行动决策上存在不足,未来可从多方向推进研究。
Claude Code与Codex六大组件拆解
文章指出如今如GPT - 5.6等模型的裸能力相近,但装进Claude Code 或 Codex CLI 后表现差距大,原因在于Agent Harness。它将编码智能体拆解为六个核心组件,详细阐述各组件作用与意义。
AI邪修时刻!Meta联手MIT投毒,左脚踩右脚强行升天
Meta的SOAR架构用错误率高的数据让模型推理能力暴涨9.3%。它选难题子集,用‘教师模型’生成含错题的‘垫脚石问题’,通过‘双层博弈’和‘有根奖励’机制让模型进步,或成AI进化新方向。
DeepSeek-R1推理智能从哪儿来?谷歌新研究:模型内心多个角色吵翻了
谷歌等机构研究指出,推理模型能力提升源于‘思维社会’,即模拟类多智能体交互结构。如 DeepSeek - R1 等在推理中展现高视角多样性,对话特征能提升推理准确率,还提出利用‘群体智慧’新方向。
看完 Manus、Cursor 分享后的最大收获:避免 Context 的过度工程化才是关键
上下文工程优化是Agent创业公司新一年竞争重点,其信息质量很大程度决定Agent表现。文章结合Manus、Cursor团队思路,给出做好上下文工程要点,如缩减上下文、搭建工具行动空间、多Agent协作等。
Claude Opus 4.1 上线,SWE-bench 验证率 74.5%,重构可靠性与安全性全面升级
Anthropic推出Claude Opus 4.1,是Opus 4重要升级版。SWE - bench验证率从72.5%提至74.5%,多文件代码重构可靠性及长链交互推理能力增强,无害响应率提升,合作率下降,定价不变。
阿里、南开大学发布免训练,视频大模型创新压缩方法
视频模型序列化处理影响推理速度与扩展性,传统token压缩方法在视频理解中有问题。阿里通义实验室与南开联合发布LLaVA - Scissor,用SCC方法和两步时空压缩策略,实验显示其性能优于其他方法。
WAIC 2025大黑马,一个「谢耳朵AI」如何用分子式超越Grok-4
当Grok - 4讲冷笑话时,中国科学家用书生Intern - S1破解癌症药物靶点密码。7月26日上海AI实验室发布并开源Intern - S1,多模态能力全球开源第一,相关平台也上线,有望重构科研生产力。