能力发现」共找到 3956 篇相关文章

产品应用7

让Claude Code更强大:解锁符号级代码检索能力

文章推荐一款免费工具Serena,它通过MCP与Claude Code对接,利用LSP协议统一调度语言服务器,让Claude Code获得符号级理解能力,极大提升处理代码的效率和准确率,安装使用也很简单。

newtype AI
新闻资讯7

对话阶跃星辰段楠:“我们可能正触及 Diffusion 能力上限”

阶跃星辰段楠指出当前视频生成技术或触天花板,真正有深度理解能力的模型尚待突破。他预测未来1 - 2年视觉领域基础模型有望出现,还分享视频生成及多模态AI未来核心洞察。

AI科技大本营
产品应用7

OpenClaw 之后我开始思考:Agent 最重要的两种能力是什么?

OpenClaw爆火后,作者思考AI Agent除执行能力外,还需审美判断力。介绍Seede AI,它与文生图工具不同,能将内容转化为可编辑设计文件,操作简单,效果惊艳,有独特技术逻辑,未来有风格预设等发展方向。

特工宇宙
算法论文8

LLM规划能力飙升79%!Google:内在自我批评技术拿下多项SOTA

Google DeepMind研究《通过内在自我批评提升大语言模型的规划能力》,不借助外部验证器,让LLM反复“自评+重写”,使Blocksworld准确率从49.8%升至89.3%,还介绍了方法及跨模型验证情况。

PaperAgent
算法论文8

都说记忆是Agent标配,但MemSyco发现漏算了一件事

厦门大学与吉林大学的最新研究指出,随着大模型Agent具备长期记忆,虽成为“长期协作者”,但也出现Memory-Induced Sycophancy问题。为此提出MemSyco - Bench评测基准,经实验得出多项发现,指出Agent Memory关键瓶颈转变。

PaperAgent
算法论文8

切开Claude大脑,Anthropic称发现了一个类似人类意识的内部空间

Anthropic在Claude模型中发现J空间,其与人类大脑全局工作空间理论相似,承载特殊内容且可干预、参与多步推理等,但模型和人脑有差异,研究也有局限性。

DeepTech深科技
算法论文8

视频模型也能推理,Sora2推理能力超过GPT-5

DeepWisdom团队研究发现视频生成模型能推理,在空间类任务上比图文模型更擅长。团队推出VR - Bench基准测试,构建客观评分体系。实验显示视频模型在空间推理有优势,相关代码和数据集已开源。

量子位
产品应用7

小米发布Qwen2.5VL升级版MiMo-VL,能力提升30%

小米发布Qwen2.5VL升级版MiMo-VL,能力提升30%。它能完成输入视觉回答问题、做几何体等任务,重点解决多模态推理、视觉理解及与人类偏好对齐问题,介绍了模型结构、训练阶段等内容。

CourseAI
新闻资讯8

Anthropic发布Fable 5.1:科研、编程能力翻倍,成本最高降45%

当地时间9月1日,Anthropic推出Claude Fable 5.1和Claude Mythos 5.1。Fable 5.1科研、编程能力翻倍,成本最高降45%,还能解决实际问题,此次模型竞争转向多方面综合较量。

DeepTech深科技
开源动态7

The Batch: 948 | GLM 5.1:面向长时任务的能力提升

Z.ai将旗舰开源权重大语言模型升级为GLM - 5.1,可在单个任务自主运行八小时。它专为编程和智能体任务设计,有推理等特性,在多榜单表现佳,但推理和数学能力落后闭源模型,价格有提升。

DeeplearningAI