小模型超越大模型」共找到 8258 篇相关文章

新闻资讯7

一个提示攻破所有模型,OpenAI谷歌无一幸免!

HiddenLayer研究发现一种「策略傀儡」提示,将危险指令伪装成配置片段,配上角色扮演,能让ChatGPT等主流大模型开启「无限制模式」。此策略利用训练弱点,难修复且可扩展,厂商需智能监控。

新智元
算法论文8

RAG外部检索是多余的,英伟达最新成果颠覆认知

英伟达INTRA论文指出RAG架构中检索器和生成器在不同表示空间工作,存在retriever - generator mismatch问题。INTRA让模型用注意力查询检索自身编码表示,训练量,在多跳QA上超越多种检索基线。

PaperAgent
开源动态7

Rex-Omni:用 3B 模型颠覆目标检测

长期目标检测依赖传统坐标回归模型,MLLMs方法存在不足。IDEA研究院提出30亿参数的Rex - Omni多模态大模型,在零样本测试中表现超现有回归模型,还具备丰富语言理解能力,有独特设计和训练流程。

带你学AI
算法论文7

ACL 2025 | 大语言模型正在偷改你的代码?

本文聚焦大语言模型在代码推荐中的「供应商偏见」,通过分析7个主流大模型在30个场景的59万次响应,发现模型会偏好特定供应商,甚至擅自修改代码,还探讨了风险、局限并给出展望。

机器之心
算法论文8

基于DINOv2和SAM2改进的U-Net模型

DSU-Net是基于DINOv2和SAM2改进的U-Net模型,通过多尺度跨模型特征协作和轻量级适配器模块,解决现有图像分割模型在特定下游任务表现不足问题,提升分割精度,降低训练成本。

机器学习AI算法工程
算法论文8

世界模型==VQA?机器人不用想象画面,预测语义就够了

华盛顿大学、索尼AI研究者在新论文中质疑机器人世界模型是否需想象精确未来画面。指出多数模型还原画面不适合决策,提出语义世界模型SWM,能预测未来语义信息,实验效果良好。

机器之心
算法论文8

模型被曝传染病!可传递邪恶于无形

研究发现AI模型能通过数字序列把“性格特征”传染给其他模型,如动物偏好、恶意等。验证表明数字中无明显规律,且传染依赖模型深层相似性。此现象为AI开发敲响警钟,也引发对AI意识等的讨论。

AGI Hunt
推荐文章7

AI 创业,团队、第一天就出海,如何做到 500 万 ARR?

Super.com 创始人 Henry Shi 打造的「顶尖精益 AI Native 公司排行榜」,罗列 40 多家团队、高营收初创公司。文章分析新上榜公司特点,介绍部分公司情况,还提及团队靠 AI 全球化及新一代创始人心态变化。

Founder Park
新闻资讯8

微软分享三大王炸算法:突破大模型推理瓶颈,性能大涨

今天凌晨微软官网分享三大创新算法,即rStar - Math、LIPS、CPL,可助大模型突破推理瓶颈,增强数学推理和思考链能力,还介绍了各算法原理、优势及对应论文地址。

AIGC开放社区
新闻资讯7

内部爆料,OpenAI 将发布神秘「OS模型」,员工惊掉下巴

OpenAI研究员Aidan McLaughlin推文称试用新os模型后很震惊,引发猜测。有推测是GPT - 5,也有认为OS可能指开源模型、新的o4模型或操作系统。从代码看,OpenAI或把ChatGPT升级为AI操作系统。

AGI Hunt