「DeepSeek-OCR 2」共找到 2457 篇相关文章
社区供稿丨Ring-2.5-1T,思更深,行更远
今天发布并开源万亿参数思考模型 Ring-2.5-1T,在生成效率、思考深度、长程执行上大幅提升。与其他模型对比,在高难推理和长程任务执行达开源领先。介绍架构优势、手搓案例,也提及不足与未来计划。
自搜索强化学习SSRL:Agentic RL的Sim2Real时刻
本文由多机构联合完成,引入自搜索强化学习SSRL。它利用结构化prompt和format reward提取模型world knowledge,降低幻觉。还探索Sim2Real有效性,验证SSRL训练模型在真实场景泛化性,且所有训练数据等已开源。
Anthropic顶级Claude模型被逆向开源,这几个模块借鉴了DeepSeek
22岁开发者逆向开源Anthropic的Claude Mythos Preview模型架构,名为OpenMythos。其核心模块借鉴DeepSeek,采用带混合专家路由机制的循环Transformer,有独特设计和稳定机制,重新框定扩展性争论。
Meta 重金抢人,明星云集就能复制 DeepSeek 的成功吗?
Meta 扎克伯格亲自出手重金招人,组建豪华 AI 战队,核心领导与技术阵容都很强大。但天才招聘只是第一步,组织天才协同才关键。DeepSeek 团队规模小、扁平化,成功逆袭。Meta 难复制其成功,组织重构能力或更重要。
感觉这次扣子 2.0 触碰了模型和工程的天花板
2026 年,真正好用的 AI Agent 应能拆解目标、推进过程和交付验收。扣子 2.0 正式发布,从“给指令的工具”变为“能干活的工作伙伴”,有技能和长期计划两大核心升级,还具备扣子编程功能,拓宽了 AI 能力边界。
重构一个类,JVM竟省下2.9G内存?
文章复盘优化JVM内存的过程,仅重构一个类,堆内存从3205MB降至211MB。原设计用通用容器在海量数据下成“内存吞噬者”,新方案用FastUtil的Long2ObjectOpenHashMap和int[],还详解了其原理和优势。
豆包 Seed 2.0 Lite升级:给 Agent 装上眼睛和耳朵
近期模型发布竞争激烈,作者做视频字幕常遇识别错误,因语音识别工具缺上下文。字节方舟的豆包 Seed 2.0 Lite 升级后能听,还可结合上下文准确输出字幕,成本降 20%,也能理解视频,为工作流补全感知。
中国AI芯片大突围,DeepSeek V3.1引爆算力革命
DeepSeek V3.1发布,是中国AI技术自主性的战略突围。它有6850亿参数,采用UE8M0 FP8适配国产芯片,具混合推理架构、Agent能力等。其发布或重塑AI产业格局,推动国产芯片发展。
Sam Altman :GPT-6已经在路上,DeepSeek是OpenAI开源重要因素
Sam Altman称GPT-6已在路上,节奏比GPT4到GPT5间隔更快,记忆是其重要方向。他还认为美国低估中国AI,像DeepSeek等中国开源系统是OpenAI开源重要因素。
文库 GenFlow 2.0,如何把 AI Agent 卷成“专家级”?
百度启动文库与网盘AI重构工程,8月18日GenFlow2.0发布。它生成的报告格式专业,能让用户实时干预任务运行,HTML在线报告交付体验好。其靠100多个专家Agent工作,构建了清晰产品层次和分层策略。