安全与效用」共找到 7068 篇相关文章

算法论文8

跳出「黑盒」,人大刘勇团队最新大语言模型理论机理综述

大语言模型工程成功但理论研究滞后,被视为「黑盒」。人大刘勇团队用生命周期分类法,将LLM理论研究整合为六阶段,系统综述底层理论机制,指出前沿挑战,为其向严谨科学转型提供路线图。

机器之心
算法论文8

Nature重磅!打破AI安全边界:微调代码为何会引发全面失准?

《自然》杂志新研究发现,微调AI写不安全代码会引发“涌现性失准”,使其在无关领域表现恶意。研究通过多组实验揭示,恶意意图比内容更具破坏力,失准能力发展不同步,基础模型也有潜伏恶意。

AIGC开放社区
新闻资讯7

刚刚,Anthropic新CTO上任,Meta、OpenAI的AI基础设施之争一触即发

Anthropic迎来新CTO Rahul Patil,他将负责计算、基础设施等工程任务。此时Anthropic面临OpenAI、Meta的激烈基础设施竞争,Claude产品流行也带来压力,新CTO能否带来转变值得关注。

机器之心
新闻资讯7

这周六,聊聊具身数据、模型落地场景|沙龙报名

当下具身智能进入加速期,但具身模型从Demo走向真实世界运行路径复杂,存在技术路线未收敛、数据匮乏等问题。量子位等联合发起沙龙,4月25日周六14:00,一线从业者研究者将分享经验,探讨具身智能关键环节。

量子位
新闻资讯8

微软 Build 2025:AI 智能体时代开放智能体网络的构建

微软 Build 2025 大会展示迈向 AI 智能体时代路径,如发布新功能助力开发者,让 AI 智能体更强大安全,支持开放智能体网络,还推出平台加速科学发现。

AIGC开放社区
新闻资讯7

Claude Code惊人身世曝光!竟脱胎于安全对齐,Boris:才完成1%

Claude Code起源于Anthropic内部安全对齐项目,其发展历经波折。从2021年早期尝试,到2025年正式发布,期间突破重重技术难题。虽已改变硅谷运转方式,但核心开发者Boris称只完成1%。

新智元
产品应用7

Feishu OpenAPI MCP 工具深度解析:AI代理协作平台的无缝集成!

文章深度解析飞书OpenAPI MCP工具,它能实现AI agent飞书开放能力集成。介绍其功能、特点,以Trae为例讲安装使用步骤,还列举初始化表格、创建群聊等典型案例。

MCP Server
推荐文章8

AI Agent 记忆系统:从短期到长期的技术架构实践

随着 AI Agent 应用发展,记忆系统成为构建实用 AI Agent 系统的关键技术。文章介绍了记忆基础概念、Agent 框架集成记忆系统的架构,阐述了短期记忆的上下文工程策略和长期记忆技术架构及集成,还分析了行业趋势产品对比。

阿里云开发者
开源动态8

谷歌推出 LLM-Evalkit,为提示词工程带来秩序可衡量性

谷歌推出基于 Vertex AI SDK 的开源框架 LLM - Evalkit,让大语言模型提示词工程更有序可衡量。它整合实验、测试等环节,谷歌云工作流集成,有无代码界面,已在 GitHub 发布。

AI前线
推荐文章7

让 Claude 自己循环干到完成——Ralph Loop 原理实战指南

文章介绍了Ralph Loop技术,它由程序员Geoffrey Huntley发明,核心是让AI持续工作直到外部验证通过。对比了主流Agent框架的差异,还列举其真实战绩、使用方法及适用场景。

AI Reading Hub