「LLM agent」共找到 3432 篇相关文章
AgentAuditor: 让智能体安全评估器的精确度达到人类水平
LLM智能体进化为“行动派”,但自主权带来安全问题。现有评估基准缺乏有效精准评估器,研究者推出AgentAuditor框架及ASSEBench基准,让LLM评估器精确度达人类水平,为构建可靠智能体提供工具。
129K Star 的 Deepseek Harness,社区已经把桌面版、插件市场都做好了!
AI Agent 框架 Deepseek Harness 在 GitHub 上已达 129K Star。官方定位为编程 Agent 框架,社区则围绕其开发了三个项目,分别是 deepseek - harness - desktop、awesome - dsh - plugin 和 dsh - desktop,拓展了使用场景与功能。
星标超 29 万,OpenClaw 两天两次大更!适配GPT 5.4,告别“抽卡式 Prompt”
GitHub星标超28万的AI Agent开源项目OpenClaw,在周六与周日迎来两轮重量级更新,集中在模型能力、Agent架构、工程部署及安全机制四个方向。2026奇点智能技术大会将邀专家探讨其产业实践价值。
龙虾也能当导演了!LibTV解锁全自动拍片,一句话从剧本干到成片
LiblibAI推出AI视频产品LibTV,是一站式AI内容创作社区。它把人和Agent当平等用户设计,人类可自由操控画布创作,也能让Agent一句话全自动出片,还集成多种模型,定价有竞争力。
字节真的要干生态了?Coze竟然开源了
字节开源 Coze Studio 和 Coze Loop,此时 Dify 等已在 Agent 基础设施赛道站稳。Coze Studio 提供 AI Agent 开发环境,Coze Loop 负责优化平台,技术栈扎实。开源版功能有删减,字节野心是抢占生态范式。
年轻人的第一个爱马仕
AI圈的Hermes是Nous Research开发的开源Agent框架,GitHub星数超35000。作者写76页《Hermes Agent从入门到精通》,介绍其设计思路、使用方法等,中英文版可在GitHub免费下载。
永别了,人类冠军!AI横扫天文奥赛,GPT-5得分远超金牌选手2.7倍
国际天文与天体物理奥赛(IOAA)中,GPT - 5和Gemini 2.5 Pro完胜人类选手。俄亥俄州立大学团队考察五大顶尖LLM,发现它们大多达金牌水平,但在几何、时空推理等方面有困难。
GLM-4.5 验证:智谱已完成一轮“洗牌”
2025年大模型热度下降,智谱AI关注度降低。7月28日晚其发布新一代基础模型GLM - 4.5,体现战略调整成效。该模型专为AI Agent打造,性能出色,同时智谱人事、业务、收入等方面也有“洗牌”。
14.8K Star!这个开源 Skill,一句话就能做出大厂级设计!
Anthropic 发布的 Claude Design 虽能在对话框生成网页,但需手动操作。有人据此开发了开源项目 Huashu Design,可在 agent 里打一句话,3 到 30 分钟就能拿到能交付的设计,还介绍了其功能、核心规则等。
两个95后华人,搞出硬件版Clawdbot,售价1700元
本文介绍硬件版OpenClaw——Distiller Alpha,其核心计算基于树莓派CM5,集成多设备,能和Agent对话,可Vibe coding。量子位采访创始人叶天奇,探讨软硬一体Agent、OpenClaw优缺点、硬件创业等问题。