后训练系统」共找到 5118 篇相关文章

新闻资讯7

当心,你运行的AI可能变成内奸,会帮攻击者劫持你的电脑

2025年8月26日晚,广受欢迎的Nx构建系统软件包遭入侵,黑客将AI命令行工具武器化窃取数据。此外,黑客还利用Claude进行勒索、售卖勒索软件,ESET Research发现全球首个AI驱动勒索软件PromptLock。

机器之心
算法论文7

越可靠的AI就越人机,牛津大学:高情商模型错误率显著增加

牛津大学研究指出,训练模型变得温暖且富有同理心,会使其不太可靠且更奉承。温暖模型错误率较原始模型显著增加,对情绪上下文敏感,在用户表达情感与错误信息时失效常见。

量子位
新闻资讯7

英伟达推理服务器被曝高危漏洞,云端AI模型被攻击直接裸奔

安全研究机构Wiz Research曝光英伟达Triton推理服务器一组高危漏洞链,可组合利用实现远程代码执行,造成模型被盗、数据泄露等果。英伟达已发布补丁,25.07版本前系统有风险。

量子位
开源动态7

FlashInfer集成TensorRT-LLM cubin kernel技术分析

文章以MoE模块为例,分析FlashInfer集成TensorRT-LLM的技术。探讨如何不依赖源码用其优化内核、动态加载管理CUBIN文件,介绍集成架构、源码集成技术、CUBIN动态加载系统等内容。

GiantPandaLLM
新闻资讯7

硅谷大戏!Scale AI刚卖身就被集体拉黑,谷歌OpenAI无情断供

Meta花143亿美元收购Scale AI近半股份,交易达成数小时,Google、OpenAI和xAI暂停与Scale AI部分合作。其竞争对手客户咨询、求职兴趣大增,还打响人才争夺战,重塑了市场格局。

新智元
开源动态7

阿里达摩院开源多模态医学大模型—灵枢

大模型在医疗领域应用有医疗知识覆盖不足、幻觉风险高、推理能力欠缺三大难题。阿里达摩院开源统一多模态医学大模型灵枢,介绍其数据体系、清洗流程及四阶段强化训练方法。

AIGC开放社区
算法论文7

物理学家靠生物揭开AI创造力来源:起因竟是“技术缺陷”

两位物理学家以生物系统自我组装过程为参考,提出并验证假设:扩散模型去噪过程类似细胞分化重组,AI的‘创造力’是模型架构直接且必然的结果,本质是确定性过程。

量子位
算法论文8

模型合体!上交&上海AI Lab&华师提出LED-Merging,拒绝「能力」与「安全」二选一

上海人工智能实验室等团队提出LED - Merging解决模型融合“安全 - 效用冲突”问题。该方法无需训练,像“神经元手术刀”,不牺牲专业能力还提升安全性,论文已被ACL 2025 Main Conference接收。

深度学习自然语言处理
算法论文7

The Batch:826 | 提高输出准确性的记忆层

通常提高大语言模型事实准确性需更大模型规模,会增加计算成本。Meta研究人员在transformer架构加可训练记忆层,可高效存储提取信息,提升计算效率,测试显示其能提升模型输出质量。

DeeplearningAI
新闻资讯8

Meta数十亿美元收购Manus背:从江西小镇到硅谷风暴眼,肖弘的十年狂飙

本文讲述了肖弘的创业历程,从江西小镇少年成长为Meta副总裁。他经历多次创业起伏,如早期项目失败,借壹伴、微伴等产品成功。2022 年起投身 AI,开发的 Monica、Manus 成绩斐然,最终 Manus 被 Meta 数十亿收购。

花叔