Nanbeige4.1-3B」共找到 2898 篇相关文章

开源动态8

清库存!DeepSeek突然补全R1技术报告,训练路径首次详细公开

DeepSeek给近一年前登上《Nature》封面的R1论文补64页技术细节,正文大幅翻修。新论文展开R1完整训练路径,补充R1 - Zero分析,还披露安全评估细节。此外团队稳定,引发对其后续动作猜测。

量子位
产品应用8

GPT-5.4 mini+nano突袭,1/3价格养满血「龙虾」!OpenAI彻底杀疯

OpenAI发布GPT - 5.4 mini和nano,继承GPT - 5.4优势,速度快、成本低。在编码、推理、工具调用等方面表现出色,可作为「龙虾」主力模型。还提出分层调度架构,且全线上线,免费用户也能用,但mini长上下文处理有短板。

新智元
新闻资讯7

Lovable 一个月新增 1 亿美金 ARR,Replit 再融 4 亿美金 Cursor 打算融 50 亿美金

今年AI Coding赛道增长疯狂且用户付费意愿强。Lovable ARR突破4亿美金且增速加快,年底或破10亿;Replit官宣新一轮融资,推出Agent 4;Cursor拟融50亿美金,其CEO称AI软件开发进入新阶段。

投资实习所
推荐文章8

GPU-MODE Leaderboards之nvfp4_gemv代码阅读

文章围绕GPU-MODE的nvfp4_gemv竞赛rank1代码展开,先介绍问题及官方baseline,后详细解读rank1代码,含数据加载、线程模型等,还剖析核心计算函数,最后总结代码在缓存控制、数据格式等方面的调优亮点。

GiantPandaLLM
开源动态7

类R1训练不再只看结果对错!港中文推出SophiaVL-R1模型

DeepSeek - R1爆火后,类R1结果奖励训练范式引发推理热潮,但仅以结果对错奖励模型有弊端。港中文联合团队发布多模态推理模型SophiaVL - R1,引入‘思考奖励’机制,还用Trust - GRPO算法解决奖励欺骗问题。

机器之心
开源动态8

WAIC 2025大黑马,一个「谢耳朵AI」如何用分子式超越Grok-4

当Grok - 4讲冷笑话时,中国科学家用书生Intern - S1破解癌症药物靶点密码。7月26日上海AI实验室发布并开源Intern - S1,多模态能力全球开源第一,相关平台也上线,有望重构科研生产力。

机器之心
开源动态8

四大顶尖模型对决!6000 字测评带你看Deepseek R1有多强

昨天 Deepseek-R1 0528 正式开源,作者让它与 Claude Opus 4、Sonnet 4、Gemini 2.5 Pro 在六个前端开发任务中对决。结果显示,Deepseek-R1 在多数测试表现出色,且价格优势明显。

歸藏的AI工具箱
开源动态8

腾讯混元世界模型1.1开源:单卡秒级重建3D世界成为现实

腾讯混元团队开源混元世界模型1.1,它是混元3D世界模型1.0升级版。新增多视图及视频输入,单卡可部署,秒级创造3D世界。有核心突破,能处理多任务,经训练策略优化,多测试表现佳。

AIGC开放社区
开源动态7

MiniMax深夜开源首个推理模型M1,这次是真的卷到DeepSeek了。

MiniMax深夜开源首个推理模型M1,其上下文能力媲美Gemini 2.5 Pro。M1在部分评测中表现中规中矩,但在MRCR(4 - needle)测试中屠榜。它得益于MiniMax - 01基座模型,应用Lightning Attention机制,开源了40K和80K两个版本。

数字生命卡兹克
产品应用8

杀疯了!单卡4090跑通全量微调,面壁1B级多模态性能怪兽硬刚大厂

面壁智能推出MiniCPM-V 4.6,参数约1B,性能和推理效率出色。它在多模态任务综合能力、推理速度上领先竞品,靠ViT架构改造和4倍/16倍混合视觉Token压缩实现创新,有工业验证,对开发者和普通用户意义大。

AI寒武纪