开源大模型」共找到 10086 篇相关文章

新闻资讯7

“龙虾”时代,模型公司的好日子来了

3月10日,MiniMax港股收涨,市值超百度。OpenClaw爆火,其创始人转发评测榜单,使MiniMax-M2.1排名突出。OpenClaw是智能体构建框架,为模型公司带来盈利转机,撬开收入天花板,引发各方关注。

远川科技评论
算法论文8

Anthropic:模型开始意识到自己在想什么!

Anthropic的Jack Lindsey论文《Emergent Introspective Awareness in Large Language Models》对模型做神经科学受控实验。发现Claude Opus 4/4.1能感知内部念头,区分内外状态,通过检查内部状态一致性判断输出意图。

深度学习自然语言处理
开源动态8

DeepSeek开源的不仅仅是个新OCR模型。。。

DeepSeek开源3B参数的新OCR模型,重新思考AI处理长文本方式,用视觉token压缩文本信息。核心组件有DeepEncoder和DeepSeek3B - MoE解码器,实验效果好,成本降低,还解决了一些算法和工程问题。

AI工程化
算法论文7

幻觉终结者,PoG给模型“打补丁”

传统检索方式易给语言模型带入噪声,知识图谱虽能提供可靠知识,但处理多跳和多实体问题有局限。Paths-over-Graph(PoG)方法通过多跳路径探索、路径剪枝等提高LLMs在复杂任务中的表现,减少幻觉。

CourseAI
推荐文章7

什么!我把SQL编辑器装进了模型

文章介绍基于约束解码技术,结合CFG、Jinja模板和XGrammar框架,为模型SQL生成配备“编辑器”。它能保证语法正确、遵循规则,还具灵活性。但面临约束干扰和性能瓶颈,未来可简化配置惠及更多用户。

阿里云开发者
算法论文8

挤干模型高分「水分」!最强模型仅49分,南傅朝友发布Video-MME-v2

南京学傅朝友团队在 Google Gemini 评测团队邀约下推出视频理解新基准 Video-MME-v2。它有创新的分层能力体系与组级非线性评分,揭示模型与人类的巨鸿沟、传统 Acc 指标虚高、“Thinking”并非总是增益等现象。

机器之心
算法论文8

首篇全新情景认知视角的模型Agent综述

中科的这篇Survey从全新情景认知视角对模型Agent进行综述,给出Agent本质,介绍Agentic AI定义、模型五层演化理论等,还以OpenClaw为例说明,旨在提供理解框架与未来方向。

PaperAgent
开源动态8

Github 4.1k star,SuperSonic AI×BI 厂震撼开源

SuperSonic 是腾讯音乐开源的下一代 AI+BI 平台,融合 Chat BI 与 Headless BI 两种范式。它解决了传统 BI 工具复杂、数据口径不统一等痛点,有丰富功能和技术优势,适用于多业务场景,开源优势明显。

小华同学ai
开源动态8

Mistral 3开源,一举超越DeepSeek与K2?

近期,Mistral AI开源Mistral 3,含三款小型稠密模型及Mistral Large 3。Benchmark对比中,它领先国内DeepSeek - 3.1、Kimi - K2。Mistral Large 3是强开源权重模型,Ministral 3适合边缘端,成本性能比低。

PaperAgent
开源动态8

The Batch: 929 | Qwen3.5 超越更模型,领跑视觉基准测试

阿里巴巴发布 Qwen3.5 系列,含 8 个开源权重的视觉 - 语言模型。其小模型表现超体量 OpenAI 开源权重模型,在视觉任务中整体出色,部分在语言任务也有竞争力。虽团队有人员离职,但阿里承诺加 AI 投入。

DeeplearningAI