「AI能力进化」共找到 11437 篇相关文章
刚刚,美团开源 SOTA 推理模型 LongCat-Flash-Thinking,性能逼近 GPT5-Thinking
美团宣布开源高效推理模型 LongCat-Flash-Thinking,性能逼近 GPT5-Thinking,是国内首个结合多种推理能力的大语言模型。它采用新方法提升性能,已在多平台开源,API 平台免费开放,还兼容主流 API 格式。
字节的 Doubao Seed 2.0 来袭,不过我想先和你聊聊扣子编程
作者介绍了AI Coding进展超预期,普通人协作就能做出实用作品。重点讲了扣子编程,它是云端Coding Agent,适合小白,接入多个大模型。还介绍了Doubao Seed 2.0升级,最后探讨了编程趋势。
狂奔AGI,Claude年终封王!自主编码近5小时震惊全网
METR报告称Claude Opus 4.5能持续自主编码5小时,超OpenAI最强编程模型。AI编码智能体任务时长指数级增长,不过迈向AGI仍面临长期记忆难题,未来一年该领域或有突破。
硬刚Sora2,万相2.6轻松定制角色、控制分镜,普通人也能当导演
2025 年视频生成领域发展迅猛,OpenAI 的 Sora 2 带来新玩法,商业落地加速,但普通用户体验门槛高。12 月 16 日阿里发布万相 2.6 系列模型,功能全面升级,实测效果惊人,标志 AI 视频生成迈向精准可控新阶段。
SDD 如何在复杂业务系统中真正落地?
文章围绕SDD在复杂业务系统落地展开,介绍OpenSpec库使用,对比与系分差异,分析其优势与问题,如LLM与IDE执行能力鸿沟、无update命令等,还对比OpenSpec和GitHub Spec Kit,并给出流程及提示词。
Meta发布40页报告,具身智能的下一步是「心智世界模型」:能听,能看,能理解,会共情
Meta发布40页报告,首次将对人心智状态的推断概念化为心智世界模型,与物理世界模型实现“双轨建模”。还指出要结合系统A和B让AI自主学习,心智世界模型在多智能体协作潜力大。
大模型是不是到顶了?瓶颈到底在哪
文章探讨大模型是否到顶,指出‘到顶’争论分三个问题,靠堆大模型提升能力之路变平,受数据和成本约束。但大模型还有后训练和推理时计算两个发展方向,未来进步或来自更会用算力。
【万字长文】Claude Skills完全指南:从概念到实战
这是万字Claude Skills指南,从概念到实战。介绍了Skills是模块化能力包,有渐进式披露设计,对比了与MCP、Subagent区别,阐述其优势。还讲了创建、设计、使用方法及分类体系,提示安全风险并推荐资源。
咖啡机变聪明后,我连咖啡都喝不上了
一位科技记者用升级到Alexa Plus的博世咖啡机煮咖啡遭拒,社区也有诸多类似吐槽。生成式AI助手虽能力提升,但因LLM随机性,在控制场景易翻车,新旧技术切换引发混乱,边界待明确。
Nature重磅!清华团队揭秘大模型新规律:告别参数内卷,智能密度每3.5个月翻一番
清华和面壁智能团队研究揭示大语言模型进化的致密律,指出为获同等智能,模型参数量呈指数级下降,最大能力密度约每3.5个月翻一番,还探讨模型压缩、边缘智能等内容。