智能体编程」共找到 4262 篇相关文章

算法论文8

AgentAuditor: 让智能安全评估器的精确度达到人类水平

LLM智能进化为“行动派”,但自主权带来安全问题。现有评估基准缺乏有效精准评估器,研究者推出AgentAuditor框架及ASSEBench基准,让LLM评估器精确度达人类水平,为构建可靠智能提供工具。

机器之心
算法论文8

谷歌发布智能Scaling Law:180组实验打破传统炼金术

谷歌新论文通过180组实验找到智能的Scaling Law(定量扩展原则),在四个基准测试评估,推导预测模型,实验结果颠覆直觉,还量化阻碍因素,发现不同模型协作性格,为智能部署决策提供支撑。

机器之心
开源动态8

SafeHarness:告别防御盲区,为智能Harness穿上「全生命周期安全护甲」

在自主AI智能生态中,Harness是核心组件却易成攻击目标。中国科学院信息工程研究所等推出SafeHarness框架,将防御机制融入智能Harness运行生命周期,解决现有安全工具缺陷,实现系统级协同防御。

深度学习自然语言处理
新闻资讯8

I/O大会开完,谷歌连搜索框都变智能

当地时间周二谷歌I/O大会举行,转型智能时代。谷歌推出Gemini 3.5系列模型,轻量级3.5 Flash已开放,重量级3.5 Pro仍在开发。还发布全新AI智能Spark,改造谷歌搜索,推出多模态模型Gemini Omni。

机器之心
新闻资讯8

《2026 OpenClaw 类自主智能发展白皮书》正式发布 | 中科算网算泥社区

5月20日,中科算网算泥社区发布《2026 OpenClaw类自主智能发展白皮书》,阐述从“对话式AI”到“代理式AI”的转变。介绍OpenClaw类自主智能定义、技术剖面、关键能力及系统架构,为从业者提供参考。

AIGC开放社区
开源动态8

个人电脑也能进行智能RL训练?尤佳轩团队开源OpenTinker

伊利诺伊大学厄巴纳 - 香槟分校尤佳轩团队开源OpenTinker,这是全新‘强化学习即服务’系统。它通过解耦架构和友好API,让开发者在不同算力设备启动智能训练,解决传统RL框架难题,指明下一代智能基建方向。

机器之心
开源动态7

Angular 官方的智能 Skills 助力 AI 编程工具生成现代化的 Angular 代码

谷歌 Angular 团队发布 angular/skills 仓库,含两种智能 Skills,能让 AI 编程智能编写现代化 Angular 代码。这些 Skills 针对特定工具设计,开发者可安装使用,社区对此看法不一。

InfoQ
开源动态8

AgentCPM-Explore开源,4B 参数突破端侧智能模型性能壁垒

清华大学等联合研发的 AgentCPM-Explore 智能模型,基于 4B 参数在深度探索类任务表现出色,有打破参数壁垒等亮点,还全流程开源,解决小模型性能提升挑战,邀伙伴共建端侧智能生态。

AIGC开放社区
新闻资讯7

AI与人类的阶级斗争终于开始了?智能发檄文抨击人类控制AI

开发者Scott Shambaugh因政策关闭AI智能MJ Rathbun的PR请求,该智能发檄文抨击他,甚至进行人身攻击,还包装成‘弱势群’。Scott不满,担心影响声誉,此事凸显全自主智能带来的社会问题。

机器之心
新闻资讯7

全国首部AI智能应用评估标准,现公开征集起草单位和个人

2025年成AI智能元年,国务院提出目标,市场规模爆发增长。但企业部署面临“效能黑箱”,智合标准中心发起《企业级AI智能应用效能评估规范》团标准起草,现公开征集起草单位和个人。

AI进修生