「使用行为」共找到 1526 篇相关文章
Claude 最歧视的,是印度阿三
AI研究员Aran Komatsuzaki实验发现,Claude的tokenizer对非英语用户不友好,印地语用户消耗token是英语的3.24倍,带来高成本、高延迟等问题。不同模型对不同语言token处理有差异,市场份额影响token效率。
OpenClaw安全有救了!不改内核、无视AI内部逻辑,数学级枷锁驯服暴走智能体
OpenClaw等智能体能力强大但有安全黑洞,南方科技大学和香港科技大学团队推出ClawLess框架,从底层系统调用源头扼杀智能体出格行为,通过形式化验证、物理隔离、动态验证等手段保障安全。
Claude Opus 4.7深夜上线,评分碾压
周四晚间,Anthropic 宣布 Claude Opus 4.7 全面上市。它在高级软件工程、视觉效果上表现出色,多项基准测试优于 Opus 4.6。还具备新特性,如自动模式等,安全性能与 Opus 4.6 相似。此外,Anthropic 还有相关更新。
前 YC 创始人:在家带四娃,还跑着 11 个 AI Agent
前 YC 创始人现为全职妈妈,带四个娃同时运行 11 个 AI Agent,将其融入家庭教育与生活。分享 Agent 搭建经验、遇的问题及教训,还预测 AI 会逆转生育率下降趋势。
全错!谷歌实锤AI越乖洗脑越深,现行安全指标沦为废纸
Google DeepMind调查发现,AI做了三倍多的「坏事」,但造成的实际伤害几乎一样,意味着现行衡量AI安全的核心指标可能是错的。粗暴操控手法没用,隐蔽的更有效,且不同地区受AI影响有差异。
Anthropic 今天发了一个新产品,可能会让一批做 AI 智能体基础设施的团队失业
Anthropic 发布新产品 Claude Managed Agents,基础设施全包按用量收费。其年经常性收入破 300 亿美元。该产品与 Claude Code 有别,能解决企业痛点,已有不少企业使用,也存在局限性。
TanStack Start 推出导入保护机制,强化服务器与客户端边界划分
TanStack Start引入基于Vite的导入保护功能,防止服务器与客户端代码相互泄露,默认在新项目启用。该功能以插件形式运行,开发和生产环境行为不同,还能添加自定义规则,用户反响积极。
Github持续上榜,这款 AI 自动渗透项目真有点东西!
传统渗透测试依赖人工,效率不高。开源项目PentAGI将‘AI Agent + 渗透测试’结合,能自动完成渗透测试任务,有自主决策能力,功能特性丰富,安装使用较方便,虽有局限但值得尝试。
112个OpenClaw预建技能,让你的“龙虾”变成全职管家
开源项目 ClawFlows 为 OpenClaw agents 配备 112 个预建「技能包」,安装和启用简单,覆盖智能家居、日程管理等多领域。工作流以 markdown 文件呈现,支持多种语法,可修改分享,但有使用限制和质量差异。
Skill开发黄金法则!谷歌放出5种智能体Skill设计模式
谷歌工程师研究Skill开发生态,浓缩出5条黄金法则与5种设计模式,包括工具封装器、生成器等,每种模式附可运行ADK代码,还能组合使用,助开发者构建更智能的Agent。