「安全信号」共找到 1045 篇相关文章
EMNLP2025 | LLM多次回答一致就一定正确吗?非也
随着LLMs在高风险领域广泛应用,其输出的事实性错误引发安全质疑。中科院计算所和美团团队论文揭示自我一致错误,传统检测方法对此失效,提出跨模型探针法提升检测能力。
OpenAI联手谷歌,开源 agents.md,正式统一Agent规则!
OpenAI和Google等大厂联手推出 `AGENTS.md` 标准,旨在用统一文档取代厂家特定配置文件,为AI Agent提供通用‘项目说明书’。它收录AI完成任务所需技术细节,支持嵌套,还倒逼开发者规范文档协作。
多突触神经元模型问世,国内团队打造类脑计算新引擎,登上《自然·通讯》
当前人工智能高能耗问题凸显,脉冲神经网络被认为更具生物合理性、能效更高,但缺乏平衡计算效率和生物合理性的脉冲神经元模型。国防科技大学与中科院团队合作提出 MSF 脉冲神经元模型,相关研究发表于《自然・通讯》。
xAI元老离职干风投,传奇人物Babuschkin长文追忆与马斯克创业战友情
xAI联合创始人Igor Babuschkin离职,计划创办Babuschkin Ventures。他回顾与马斯克创业经历,分享从其身上学到的经验。此前他在DeepMind、OpenAI任职,在xAI构建基础工具,领导建成超级计算集群。
AI应用如何落地政企?首先不要卷通用大模型
ISC.AI 2025大会显示智能体技术加速渗透产业。360政企AI业务与智能体深度绑定,其落地有三重逻辑:不追通用大模型,聚焦小场景;用“乐高式”工厂赋能;安全与AI深度融合是必选项。
腾讯发布Hunyuan-GameCraft!从静图进入动态游戏世界
近年来,现有方法难满足游戏视频生成需求。腾讯推出Hunyuan - GameCraft,可基于一张图像和提示词生成游戏交互视频,能精准响应交互信号,保留历史场景信息,不过动作空间待丰富。
AGI真方向?谷歌证明:智能体在自研世界模型,世界模型is all You Need
谷歌DeepMind研究人员表明,通用AI智能体处理复杂长期任务需学习内部世界模型,还证明可从智能体策略提取该模型。此研究成果补充多领域,对AI发展和安全意义重大。
刚刚,AI科学家Zochi在ACL「博士毕业」,Beta测试今日上线
Intology宣布AI科学家Zochi论文被顶会ACL主会录用,成首个独立通过A*级别会议同行评审的AI系统,还开放Beta测试。其研究成果显示语言模型安全措施或有不足,Zochi工作成果多且质量高。
Palo Alto5亿美元收购的Portect AI都有什么产品和技术?
2025年4月25日,Palo Alto Networks超5亿美元收购Protect AI,为客户提供端到端人工智能安全保障。Protect AI有两个开源软件ModalScan、LLM Guard和三个平台产品Gardian、Recon、Layer,防护方案完整。
LoRA中到底有多少参数冗余?新研究:砍掉95%都能保持高性能
这篇创新研究介绍了LoRI技术,证明即使大幅减少LoRA的可训练参数,模型性能依然强劲。研究团队在多个任务上测试了LoRI,发现仅训练LoRA参数的5%,LoRI就能匹配或超越其他方法的性能。