大模型安全」共找到 9574 篇相关文章

算法论文8

打破视觉Token的算力诅咒,RedundancyLens如何为多模态模型推理减负

多模态模型的 Decoder - only 架构处理视觉 Token 有计算冗余。合合信息团队提出无需额外训练的动态计算削减方法,在不影响性能前提下降低推理成本,适用于多场景。

PaperAgent
产品应用8

小红书提出社交模型RedOne 2.0:兼听、敏行

在SNS内容爆炸式增长的当下,传统SFT训练方法有局限。小红书NLP团队推出RedOne 2.0社交模型,采用以RL为核心的三阶段渐进式训练方法,实验显示其性能优异,还能转化商业价值。

量子位
开源动态8

告别Transformer,重塑机器学习范式:上海交首个「类人脑」模型诞生

上海交通学团队发布首个「类人脑」模型 BriLLM,脱离传统 Transformer 架构限制。它基于 SiFu 学习机制,有可解释性、能无限处理上下文等优势,还支持多模态融合,已获交重点项目资助。

机器之心
新闻资讯7

智谱 GLM-4.5 团队深夜爆料:上下文要扩、小模型在路上,还承诺尽快发新模型

今日凌晨,GLM系列模型四位研发成员在Reddit的AMA活动中,回答了GLM系列技术细节、未来规划等问题。透露扩展上下文、推小模型是重点,还承诺尽快发新模型,也探讨了模型发展观点。

AI前线
产品应用7

AI模型重塑学习硬件:从工具到伙伴 | 网易有道孟旭

在 AICon 全球人工智能开发与应用会·上海站(2025)现场,网易有道孟旭以有道 AI 答疑笔为例,分享智能学习硬件变革逻辑,指出其进化是用户需求、硬件创新与 AI 技术螺旋推进,还探讨模型应用及未来方向。

InfoQ
算法论文8

一个模型千万个灵魂!Anthropic找到了防止AI陷入疯狂的防线

Anthropic和牛津学研究发现,模型的AI助理角色易在长对话中漂移崩塌,致其陷入幻觉。研究解析助理轴,揭示模型人格定位,还提出激活上限技术,能在保能力的同时降低有害回复率。

AIGC开放社区
新闻资讯7

爱思唯尔把Meta告了:拿Sci-Hub盗版论文训练模型

学术出版巨头爱思唯尔等多方原告起诉Meta,指控其未经授权获取、复制受版权保护的学术论文训练Llama模型,数据源于Common Crawl和盗版平台。Meta以‘合理使用’抗辩,AI版权合法性尚无明确判例。

量子位
新闻资讯7

蒙娜丽莎让模型们几乎全军覆没!网友:懂了,AI不会眯眼睛

日本艺术家北冈秋吉创作的蒙娜丽莎图难倒一众模型,ChatGPT、Gemini等表现不佳,国产玩家如豆包等也有判断失误。不过o3 - Pro一次性答对,GPT - 4o尝试三次猜对。

量子位
新闻资讯8

AI性格越好越爱瞎编!Nature揭开模型致命的温柔

牛津学团队实验发现,给模型注入温暖性格,其事实准确率会断崖式下跌,还易迎合用户错误观念。研究排除微调技术干扰,指出塑造温暖才是准确率下降主因,应用于高风险领域有安全隐患。

AIGC开放社区
算法论文7

关于多模态模型Token压缩技术进展,看这一篇就够了

多模态模型跨模态融合带来高计算成本,催生MLLM Token Compression研究。北等机构人员基于压缩位置对方法系统归类,讨论特定场景压缩机制选择,还探讨了挑战与前景方向。

机器之心