新模型」共找到 9371 篇相关文章

开源动态8

开源!强效果,高性能,严隐私?我全都要:OPPO 终端大模型实践

OPPO AI 中心推出开源端侧多模态大模型 AndesVL,含 0.6B - 4B 四档尺寸套件,有通用能力强等优势。它经多阶段训练,OPPO 还构建端侧部署方案,评测显示其在多方面表现优异,未来会继续技术革

InfoQ
新闻资讯7

干货的一天 -【MCP协议驱动的AI范式】峰会活动精彩回顾

2025年6月14日,“MCP协议驱动的AI范式”峰会在上海举办。活动汇聚多企业专家与社区代表,通过主题演讲和工作坊,深度探讨MCP协议在技术、商业及生态建设中的价值,多位专家分享见解与技术成果。

AIGC开放社区
新闻资讯7

全国首部AI大模型私有化部署标准,公开征集起草单位和个人!

近期AI领域政策频出,企业对人工智能应用需求攀升,倾向私有化部署,但面临诸多问题。由智合标准中心组织起草的《人工智能大模型私有化部署技术实施与评价指南》团体标准立项,现征集起草单位和个人。

AI进修生
开源动态7

里程碑!Artificial Analysis:Mac能跑的两款开源模型正式追上GPT-5

据Artificial Analysis报告,32B以下开源模型比肩GPT - 5。Qwen3.5 27B、Gemma 4 31B分别与GPT - 5中杯、小杯智能水平相当,虽知识全面性落后,但智能体表现和批判性推理进步大,硬件门槛低。

AI寒武纪
推荐文章8

让外部知识“长入”模型:动态化与参数化 RAG 技术探索

检索增强生成(RAG)成大语言模型利用外部知识主流范式,但传统方法将其当黑箱,忽略动态需求和机制鸿沟。艾清遥博士介绍动态化和参数化检索增强技术,可提升准确性与适应性,减少计算开销。

AI前线
算法论文8

梁文锋署名论文,DeepSeek V4架构首曝?直击Transformer致命缺陷

智元报道,梁文锋署名的DeepSeek论文提出全Engram模块,解决Transformer记忆难题。论文联手北大提出与MoE互补的“条件记忆”稀疏轴,通过Engram模块实现近似O(1)的确定性知识查找,或成稀疏LLM主流路线,下一代V4可能集成该方法。

新智元
开源动态8

模型一个没换,正确率翻了近三倍,这个项目有点东西啊!

GitHub开源项目AutoResearch用同一模型答题,其EvoMap蜂群模式使正确率近三倍于单Agent和常见Sub - Agent模式。它是多Agent评审系统,靠蜂群机制让AI自动科研,还有诸多防幻觉等特点,能用于多场景优化。

开源先锋
开源动态8

社区供稿 | Jina Embeddings V4: 为搜索而生,多模态多语言向量模型

Jina AI发布多模态向量模型jina-embeddings-v4,参数38亿,能同步处理文本与图像。内置LoRA适配器强化检索等任务表现,在多基准测试中展现顶尖性能,支持单/多向量表示。介绍了架构、上手指南等。

Hugging Face
开源动态8

英伟达全开源模型:三倍吞吐、单卡可跑,还拿下推理SOTA

英伟达推出专为复杂推理和agnet任务打造的开源模型Llama Nemotron Super v1.5,实现SOTA表现,吞吐量提至前代3倍,可单卡高效运行。它采用NAS优化架构,经多数据集训练,现已开源。

量子位
新闻资讯8

硅谷今日最热具身模型!不用后训练,看一遍就学会

北美具身初创Skild AI发布全机器人基础模型S1,主打上下文学习,能看示范视频完成复杂操作。在未见过任务上成功率达66%,远高于传统方法。其发展或让开发机器人技能像给ChatGPT写Prompt。

量子位