V3.1模型」共找到 9068 篇相关文章

开源动态7

MiniMax深夜开源首个推理模型M1,这次是真的卷到DeepSeek了。

MiniMax深夜开源首个推理模型M1,其上下文能力媲美Gemini 2.5 Pro。M1在部分评测中表现中规中矩,但在MRCR(4 - needle)测试中屠榜。它得益于MiniMax - 01基座模型,应用Lightning Attention机制,开源了40K和80K两个版本。

数字生命卡兹克
新闻资讯8

GPT-5≈o3.1!OpenAI首次详解思考机制:RL+预训练才是AGI正道

OpenAI研究副总裁Jerry Tworek在播客访谈中称,GPT-5类似o3.1。他详解模型推理过程,强调RL+预训练是AGI正道,肯定DeepSeek的GRPO算法,还分享自身经历及OpenAI工作结构。

量子位
算法论文8

首次披露!DeepSeek V3 发布软硬一体协同训练论文,公开「降成本」秘诀

DeepSeek团队发布论文《洞察DeepSeek - V3:规模的挑战和对AI架构硬件的思考》,从硬件架构和模型设计双重视角,探索其经济高效的大规模训练和推理方法,介绍了设计原则、低精度驱动等多方面内容及降成本秘诀。

AI科技评论
推荐文章7

Fable 5 订阅权限又续了 5 天!与其被吊着,我找了个账单只有 1/3 的替代方案

Anthropic将Fable 5订阅权限延长至7月12日,但使用不稳定且价格贵。作者介绍OpenSquilla 0.5.0 Preview,其多模型集成协作方案用国产模型组队,成本低且分数可与Fable 5打平,不过也有适用边界。

花叔
产品应用8

字节最强多模态模型登陆火山引擎!Seed1.5-VL靠20B激活参数狂揽38项SOTA

5月13日,火山引擎在上海发布5款模型和产品,其中豆包1.5・视觉深度思考模型(Seed1.5-VL)最吸睛。它激活参数20B,性能与Gemini2.5 Pro相当,38个评测基准达SOTA,推理成本低,已开放API。

机器之心
产品应用8

真碾压Sora了!谷歌Veo 3首次实现音画同步,视频模型直接「开口说话」

谷歌正式发布Veo 3,它能生成高质量视频,还能理解原始像素,自动生成与画面同步的对话、多种音效。得益于DeepMind的V2A底层技术,其音画合成功能领先。虽有时长和使用门槛限制,但已足够震撼。

机器之心
算法论文8

上下文记忆力媲美Genie3,且问世更早:港大和可灵提出场景一致的交互式视频世界模型

交互式长视频生成缺乏稳定场景记忆,制约下游应用落地。Google DeepMind的Genie 3有强场景一致性但未公开技术细节。港大和可灵提出的Context as Memory模型,上下文记忆力媲美Genie 3且投稿更早,还提升了计算效率。

机器之心
新闻资讯8

谷歌IMO金牌级Gemini 3深夜上线!华人大神挂帅,OpenAI无力反击

谷歌DeepMind推出IMO最强金牌模型Gemini 3 Deep Think,以2.5倍暴力性能碾压GPT - 5.1。它在多项基准测试表现出色,已在Gemini App上线。谷歌还将在新加坡组精英团队,由华人科学家Yi Tay率队。此外,Gemini 3 Pro使网页端市占率创新高。

新智元
产品应用8

Jina Reranker v3: 全新“列式”重排器,0.6B参数刷新文档检索SOTA

Jina AI推出第三代重排器Jina Reranker v3,在多语言检索基准上刷新SOTA。它参数仅6亿,有“last but not late”交互机制,能一次性处理查询和文档。还提供动态量化格式,方便不同硬件部署。

Jina AI
开源动态8

2 天斩获 3.5K 标星!GitHub 惊现神器!一个二进制文件把 DeepSeek V4 搬进终端

GitHub上的DeepSeek TUI项目开源两天获3.5K Star,它把DeepSeek V4模型搬进终端成编码智能体,有原生RLM并行推理等亮点,提供多种安装方式、支持多提供商,适合终端开发者。

开源星探