「DeepSeek系列模型」共找到 8132 篇相关文章

算法论文8

综述238篇遥感微调!清华院士团队指出9大方向 | CVMJ

在大数据和大模型推动下,遥感微调技术从全参数微调发展到混合微调。清华等团队在CVMJ期刊梳理技术脉络,涵盖适配器、提示等微调方法,还指出9个潜在研究方向,助力遥感技术应用。

新智元
新闻资讯8

奥特曼:OpenAI上市,势在必得

OpenAI完成架构重组,为IPO铺平道路。奥特曼公开AGI路线图,预计十年内迈入AGI时代。重组解除盈利上限,可自由增发股票和上市。微软支持转型,双方续约合作。OpenAI在技术、商业等多方面有新进展与规划。

新智元
开源动态7

只要强化学习1/10成本!翁荔的Thinking Machines盯上了Qwen的黑科技

新智元报道,翁荔的Thinking Machines研究同策略蒸馏策略,能以1/10强化学习成本,结合同策略训练优势与密集奖励信号。该策略受DAGGER启发,扩展Qwen3团队工作,可在Tinker复现,还能用于个性化和持续学习。

新智元
开源动态7

SGLang Model Gateway 0.2 发布:企业级一体化AI原生编排

市面上一体化AI原生编排方案稀缺,Oracle和SGLang团队推出SGLang Model Gateway 0.2。它从SGL - Router重构而来,核心能力升级,架构分三层,部署灵活,还支持Kubernetes集成和向后兼容。

AI工程化
新闻资讯8

腾讯发布超低成本AI训练法!120元效果秒杀70000元微调方案

腾讯提出无训练组相对策略优化Training-Free GRPO,无需调整参数,在提示词中学习经验就能提升模型性能。实验显示,该方法在数学推理和网页搜索任务上效果显著,成本远低于传统方法。

量子位
开源动态8

清华&巨人网络首创MoE多方言TTS框架,数据代码方法全开源

清华与巨人网络联合首创 DiaMoE-TTS 多方言 TTS 框架,数据、代码、方法全开源。它基于 IPA 体系,有 MoE 架构和低资源适配策略,在多语种验证,为方言语音合成提供低成本、可扩展方案。

机器之心
产品应用7

OPPO新AI操作系统,走出屏幕“指哪答哪”,嘈杂环境只听你声音

OPPO新一代AIOS ColorOS 16来了,“一键闪记”和“一键问屏”功能有新玩法。“一键闪记”能记取餐码等,还会“记忆共生”;“一键问屏”走出屏幕,嘈杂环境也能只听你声音。此外,OPPO宣布全新AI技术架构。

量子位
算法论文8

斯坦福新论文:微调已死,自主上下文当立

斯坦福大学等机构研究人员新论文指出,依靠上下文工程,无需调整权重,模型也能变聪明。他们提出智能体上下文工程ACE,不依赖模型重训,让上下文自主进化,在多场景测试中表现优于多种方法。

量子位
新闻资讯8

OpenAI奥特曼认错:我天生不适合管理公司

OpenAI CEO奥特曼在a16z采访中回应热点问题,阐述三大核心战略,谈及Sora 2等热点话题,还称自己不适合管理公司。他提到目标、对垂直整合看法、Sora与AGI关系等内容。

量子位
推荐文章7

人生周报v044:费曼

文章围绕AI应用展开,指出人机交互是AI应用竞争壁垒,介绍典型案例及交互形态,分析Agent不同场景,还提及AI应用创业要素,最后推荐《费曼经典:一个好奇者的探险人生》。

李继刚