「视听场景理解」共找到 2639 篇相关文章
我做了个 Skill:让 AI 帮你生成 Logo 和图标
作者因用 Gemini 为 CodePilot 生成 Logo 获关注,开发了 Logo Generator Skill。该 Skill 可三步生成 Logo 与高级展示图,还介绍了不直接用 AI 画 Logo 的原因、使用场景、开源地址与安装方式。
FlowUs 创始人创立 Kollab,要为 AI 构建团队大脑
AI 从对话框向 Agent 等形态演变,完成单个任务能力增强,但工作场景中仍有协作断裂问题。Kollab 产品想解决此问题,让任务在组织自动流动,切中 Team - level AI,有共享工作空间等 4 个层级。
陶哲轩:AI 正在让“想法”变得廉价,而真正的瓶颈从未改变
数学家陶哲轩与Dwarkesh Patel访谈,探讨AI在科学发现中的作用。他指出AI让‘想法生成’成本降为零,验证想法成新瓶颈;AI擅长广度,人类擅长深度;AI负责找证明,人类提炼‘理解’与‘智慧’。
OpenClaw代码越改越崩?新研究EvoClaw揭示:Agents持续开发成功率仅13.37%
USC邓港大等联合发布评估基准EvoClaw,揭示AI在持续开发场景下表现不佳,成功率仅13.37%。研究还指出当前评测易高估AI能力,提出DeepCommit重构演进历史,分析各模型在持续演进中的局限与问题。
对抗KV Cache压缩的脆弱性:两行代码以最坏风险控制防御底层假设崩塌
中科大团队在 ICLR 2026 论文中指出 KV Cache 压缩领域底层假设存在缺陷,主流方法基于的稳定性假设在真实场景中脆弱。团队提出防御性聚合策略,仅两行代码修改,显著提升 KV Cache 压缩性能。
"将注意力旋转90°":深入浅出解读 Kimi 最新出圈成果
Kimi论文‘ATTENTION RESIDUALS’引发AI圈热议,马斯克等大佬高度评价。该论文由17岁高中生陈广宇参与,提出‘注意力残差’机制,解决标准残差问题,分全、分块注意力残差,权衡开销与效果。
慕思联手华为鸿蒙,完成一场卧室里的“静默实验”|甲子光年
在AI浪潮下,睡眠场景需“静默革命”。慕思联手华为鸿蒙推出鸿蒙智选慕思智能床Pro H - Design,采用底层代码级深度共研,还自研传感技术与算法,构建闭环服务用户,重写智能床竞争逻辑。
OpenClaw 火了半年,Agent 执行层依然是工程空白
当前主流 Agent 工具链执行层基本空白,Violoop 是少数在执行层做系统化设计的项目。它是桌边触屏硬件,获取三类运行时数据,具备感知 - 判断 - 执行运行时,有多种核心能力,适合特定场景团队评估。
26.7K 标星!GitHub 高分教程 Learn Claude Code:12 节课带你手搓一个 Cursor!
Learn Claude Code是shareAI - lab开源教学项目,目标是让人理解AI编程Agent工作原理。它有12节课,每节加一个机制,逻辑清晰。配交互式Web平台,文档‘心智模型优先’,还提供后续项目助知识落地。
企业级AI Coding的落地方法,都在这本实战手册里了|甲子光年
春节后字节上线TRAE企业版SOLO模式,发布《2026企业级AI编程实践手册》。TRAE企业版SOLO模式有自主规划、工具集成、多任务并行等能力。手册沉淀字节经验,提供方法论和场景实践,助企业迈入AI原生软件工程时代。