DeepSeek - V3.1 - Base」共找到 3714 篇相关文章

算法论文8

ICML 2025|如何凭「自动补全」实现100K生成3×加速?

在大模型推理复杂的当下,生成超长文本成本高。BIGAI NLCo团队提出推理加速框架TokenSwift,被ICML 2025接收。它重构传统自回归推理,解决长生成瓶颈,在多模型实验中表现亮眼。

机器之心
新闻资讯7

「斯坦福AI小镇」创业即获投1亿美元!李飞飞卡帕西都投了

2023年斯坦福团队构建AI小镇Smallville,其智能体可自主生活。如今团队创业成立Simile,获1亿美元融资,李飞飞、卡帕西跟投。它将升级架构构建大规模模拟平台,用于人类决策的风险预测。

量子位
推荐文章8

3年、1万人,快手技术团队首次系统披露AI研发范式升级历程

快手首次系统性披露自2023年以来的AI研发范式升级历程。其研发效能演进分三阶段,从平台化到智能化,虽遇个人提效难传导至组织提效的问题,最终仍找到提升需求端到端交付效率的路径。

InfoQ
新闻资讯7

离开大疆后,他年入百亿,把3D打印机干到世界第一

本文讲述拓竹科技创业历程。创始人陶冶等5位大疆工程师2020年出走创业,秉持极客文化,推出多款产品,让消费级3D打印机易用且低价。2025年营收破百亿,还面临大疆等竞争。

芯师爷
8

从6人日到1人日:一次AI驱动的客户端需求开发实战

文章分享AI驱动客户端需求开发实战,从实践活动汇总AI Coding问题,给出解决建议。以穿搭动态框架需求为例展示开发过程,对比效率提升300%,还探讨需求拆分、Prompt编写等问题,介绍业务开发范式。

阿里云开发者
产品应用8

微软上线Deep Research:OpenAI同款智能体,o3+必应双王炸

今天凌晨微软在官网宣布,Azure AI Foundry中上线Deep Research公开预览版,这是支持API和SDK的OpenAI高级智能体研究能力产品。它通过必应搜索与GPT系列模型深度协同,将研究流程全面自动化。

AIGC开放社区
推荐文章8

翁荔新博客提出「自进化先从Harness开始」,DeepSeek崔添翼转发附议

前OpenAI安全副总裁翁荔新博客探讨AI自进化,提出从Harness开始的现实路径。DeepSeek崔添翼转发附议,认为Harness方向自进化很可能出成果。翁荔梳理研究,展示优化递进趋势,也指出实现递归自我改进存在的瓶颈。

量子位
开源动态8

超越GPT-5.2和Gemini-3-Pro!商汤多模态搜索、推理模型开源

商汤开源多模态自主推理模型SenseNova - MARS(8B/32B双版本),它通过强化学习整合工具,在多模态搜索与推理测试中超越Gemini - 3 - Pro与GPT - 5.2,还采用创新算法稳定训练,构建新基准评测。

AIGC开放社区
算法论文8

时空压缩!剑桥大学提出注意力机制MTLA:推理加速5倍,显存减至1/8

在大语言模型发展中,Transformer自注意力机制有计算复杂度问题且KV缓存成推理瓶颈。剑桥大学提出MTLA,结合时空压缩策略,提升推理效率,在多任务中表现出色,代码已开源。

机器之心
开源动态8

DeepSeek V4没做的,MiniCPM-o 4.5给做「全」了~

上周 DeepSeek V4 发布,遗憾不是多模态。今天 MiniCPM-o 4.5 补上短板,凭 9B 参数实现端到端全双工全模态大模型,自 2026 年 2 月发布后 Hugging Face 下载量超 25 万。还推出多项成果,性能表现出色。

PaperAgent