通用大模型」共找到 9351 篇相关文章

算法论文8

提示词压缩竟成模型新漏洞?港科提出黑盒攻击框架COMA | ASE 2026

香港科技学研究发现,模型的“提示词压缩”模块会重写系统安全边界,成为新攻击面。团队提出“对抗性信息损失”概念和COMA攻击框架,实验有效,还给出隔离压缩防御方案。

机器之心
新闻资讯7

Karpathy:模型交互的第三种范式来了?这是不是夸其词

Anthropic 上线 Claude Tag,可让团队在 Slack 与 Claude 协作,能完成写 PR、数据分析等任务,有多人协作、积累上下文等特点。Karpathy 认为这是模型 UI 第三次改,但评论区有质疑,不过有咖背书或成‘数字员工’。

AI工程化
算法论文8

一篇模型Agentic框架到应用最新综述

这是首篇系统拆解“模型Agentic推理框架”的综述,不聊训练,只聚焦如何把LLM组织成会思考、协作、调工具的Agent,横跨科学发现、医疗、软件工程、社会经济模拟四战场,给出统一语言、视角和评测。

PaperAgent
新闻资讯8

产业级 Agent 如何破局?百度吴健民:通用模型难“通吃”,垂直场景才是出路

InfoQ 采访百度吴健民探讨产业级 Agent 破局点。他指出 Agentic 模型训练卡点在真实环境复刻;通用模型难“通吃”,垂直场景定制模型是关键;多模态未实现统一建模,分开优化效果更好。

AI前线
新闻资讯7

Show me《指环王》!卡帕西强推模型评测新基准

神卡帕西宣称Anthropic用《指环王》给模型评测上强度,这一‘指环王基准’正接替‘鹈鹕骑自行车’SVG测试。虽Opus 5生成的画面粗糙,但网友测试展现出丰富创意,不过新测试也引发争议。

量子位
开源动态8

英伟达新架构引爆全模态模型革命,9B模型开源下载即破万

英伟达推出全模态模型OmniVinci并开源,其90亿参数规模性能超同级别甚至更高级别模型,训练数据效率是对手6倍,能精准解析视频和音频,在多模态应用场景中表现卓越,下载量破万。

新智元
新闻资讯7

全国首部AI模型私有化部署标准,公开征集起草单位和个人!

模型浪潮下,企业对AI投入加,私有化部署需求凸显,但缺乏成熟实施框架。全国首部AI模型私有化部署标准《人工智能模型私有化部署技术实施与评价指南》应运而生,已聚集30余家单位参编。

AI工程化
算法论文8

模型能力,小模型成本!Google等 | 提出递归混合框架:MoR, 幅提升LLM计算效率

Google提出递归混合框架(MoR),融合参数共享与自适应计算。它有轻量级路由和KV缓存策略,在不同路由机制各有优劣。实验显示,MoR在性能、计算和内存效率上表现出色,有望实现“模型能力,小模型成本”。

AINLPer
开源动态8

中科院类脑模型SpikingBrain,2%数据,百倍速度

中国科学院自动化研究所李国齐、徐波团队发布全球首款规模类脑脉冲模型SpikingBrain 1.0。它处理长文本比主流Transformer模型快超百倍,训练数据仅为2%。该模型采用新架构,降低计算复杂度,还可转换现有模型,且在国产GPU完成训练。

AIGC开放社区
算法论文8

ICML 2025 Oral | 从「浅对齐」到「深思熟虑」,清华牵头搭起模型安全的下一级阶梯

语言模型加速进入高风险应用场景当下,“安全对齐”是挑战。如今广泛采用的“浅对齐”脆弱不堪。清华团队提出STAIR框架,能提升开源模型鲁棒性,还推出RealSafe - R1模型进行安全对齐。

机器之心