「使用行为」共找到 1525 篇相关文章
把大厂 10 年的职场经验,做成了一个「Coze Skill」—— 扣子 2.0 深度实测
作者实测扣子 2.0,介绍其「技能商店」功能,可将专家方法论封装成技能供调用。通过简历诊断、画架构图、生成 GEO 稿件三个场景展示提效作用,还提及「长期计划」功能,称扣子定位职场 AI,降低使用门槛。
Cursor 1.7 新增 Agent 生命周期管控钩子函数
Cursor 1.7 版本推出钩子系统,可在预定义生命周期节点拦截并修改 Agent 行为,如阻断命令、自动运行工具等。早期反馈有好有坏,虽有团队探索集成,但应用范围有限,还存在文档缺失等问题。
如何让 AI 成为你的编程搭档?一次真实重构告诉你答案
文章介绍编程工具Cursor,它是基于VS Code、深度集成AI的智能代码编辑器,有多种模式,能力强但有局限。作者分享用其完成重构需求的过程、经验,还提及使用中踩坑及应对方案,最后总结提效成果。
对话清华商宇丨从生成视频到支撑行动,世界模型需要新的评测标准
文章围绕清华团队提出的 WorldArena 评测框架展开。它针对具身世界模型,对过去沿用视频生成的评测逻辑重新审视,从视觉质量和功能性任务两维度评估,推动世界模型从‘生成世界’迈向‘使用世界’。
DeepSeek-V3.2正式版发布,将开源模型的能力推向极致
DeepSeek-V3.2正式版开源,包含标准版和Special版。它采用稀疏注意力机制,降低计算复杂度。后训练阶段有多项算法改进,支撑高难度推理。还融合思考与工具使用,合成训练数据,在智能体评测表现优异。
社区供稿 | GLM-4.5技术博客:原生融合推理、编码和智能体能力
文章介绍 GLM-4.5 和 GLM-4.5-Air,二者旨在统一推理、编码和智能体能力。在 12 个基准测试中表现良好,采用 MoE 架构等技术,还开源 slime 框架。文中展示其多方面应用,并说明使用方式。
Gaia2 与 ARE:赋能社区的智能体评测
文章介绍 Gaia2 与 ARE,Gaia2 是智能体基准 GAIA 升级版,能分析复杂行为,与 ARE 框架一同发布。ARE 可模拟复杂真实条件,支持定制。文中对比多款模型,指出当前模型挑战,并说明评测步骤和 ARE 使用场景。
微软CPO专访:Prompt是AI时代的PRD,产品经理的工作方式已经彻底变了
微软首席产品官 Aparna 认为,Prompt 正取代传统 PRD 成构建产品起点,NLX 将成新用户体验设计范式,还解释了 Agent 核心特征。她觉得 Agent 本质是工具,未来可让其承担更多任务,产品经理关键在于「好品味」和「编辑能力」。
2亿多人开始和AI打电话,他们在聊什么?
2025年12月豆包月活达2.27亿,越来越多人与它语音通话。此前AI语音交互存在问题,豆包升级为全双工模型,体验更像打电话。作者实测其在不同场景表现出色,还分享使用技巧,并对比了和ChatGPT语音的优劣。
龙虾史上最大升级!但接了微信的千万别更
时隔九天,虾父Peter带来龙虾全新版本2026.3.22-beta.1,堪称有史以来最大更新。更新亮点包括插件升级、模型更新、交互优化、安全强化等,也修复了多个关键安全漏洞,但部分用户更新后遇到微信、WhatsApp使用问题。