「万相大模型」共找到 9333 篇相关文章

开源动态7

详解Github 35K+项目:打通200+数据源,构建企业级AI的数据统一入口,支持MCP【上篇】

文章实测开源的AI数据统一访问引擎MindsDB,介绍其架构、安装启动方法,展示跨多数据源统一查询、AI模型赋能数据查询等功能,还将在下篇介绍知识库与智能体特性。

AI大模型应用实践
算法论文8

一个标点就能迷惑LLM-as-a-Judge!

论文揭露惊人漏洞,一个标点或通用推理开场白就能欺骗最先进的LLM裁判,导致强化学习训练崩溃。研究通过实验验证漏洞,提出Master - RM模型,其FPR近乎0%且保持通用裁判能力。

深度学习自然语言处理
新闻资讯8

深圳SEO&GEO大会:搜索没死,只是竞争规则变了!

深圳SEO&GEO大会探讨搜索新形势,多位嘉宾分享见解。如Zac老师认为AI增长不代表搜索失价值,SEO应随搜索逻辑升级;Paul老师提出大品牌应将SEO目标转向争答案席位等。

白杨SEO优化教程
算法论文8

训练提速5倍,响应缩短50%:动态自感知能力,重塑高效LLM Reasoning范式

大型语言模型“思维链”技术有冗余,传统优化方案存在静态先验与动态能力错配问题。论文提出的DR.SAF框架赋予模型动态自感知能力,通过三模块协作,实现推理“精准瘦身”,解决根本冲突。

深度学习自然语言处理
新闻资讯8

AI不是比人聪明,是输得起!菲尔兹奖得主点破OpenAI十项成果

OpenAI发布内部版模型Astra的十项成果,引发数学界震动。菲尔兹奖得主Timothy Gowers分析其成果,指出AI优势在‘输得起’,还探讨找例方法、模型短板,给出训练建议与衡量跨越门槛的标准。

新智元
开源动态7

挑战 Claude Code,9.5 万星!又一款开源 AI 编程神器火了

开源AI编程工具OpenCode亮相,具备原生终端界面、多会话支持,兼容75种以上模型,提供桌面版和IDE插件。它允许沿用付费订阅,内置免费模型,与多种LSP服务器整合,适配多种编辑器,采用‘隐私优先’架构设计。

InfoQ
开源动态8

“边说边思考”,Mini-Omni-Reasoner 开创实时语音推理新范式

Mini - Omni - Reasoner将推理能力引入大型语音模型,开创“边说边思考”范式,实现实时语音推理与交互。推出Spoken - Math - Problems - 3M数据集,经四阶段生成流程构建。训练采用分阶段策略,性能超基础模型。

GitHubStore
新闻资讯8

Mamba一作预告新架构!长文论述Transformer≠最终解法

Mamba一作将演讲整合成科普长文,探讨SSMs和Transformer模型权衡之术。认为Attention非万能,Transformer是阶段性最优。几天后将发布新架构,能与Transformers兼容,还回顾了两模型特点及结合优势。

量子位
开源动态8

Agent 框架协议“三部曲”:MCP、A2A、AG-UI

文章介绍Agent框架的三个主流协议。MCP解决AI Agent和外部工具交互问题,获三大巨头支持;A2A促进独立Agent间通信,但MAS系统不成熟致其未普及;AG-UI解决AI Agent与前端应用交互标准化问题。

阿里云开发者
算法论文7

VaseVQA:考古领域实现专家级,诊断+补弱RL框架

在文化遗产与人工智能交叉领域,研究人员提出把大型多模态模型放于‘诊断—补弱—精细化评估’闭环训练,配套结构化评测基准,让模型在文化遗产领域接近专家级能力。介绍了技术步骤、数据基准及关键发现等。

新智元