分析 - 解析范式」共找到 2206 篇相关文章

开源动态7

从一行代码发现DeepSeek的秘密:Model1到底是什么?

在DeepSeek - R1发布一周年时,有人在GitHub的FlashMLA代码仓库发现神秘代号Model1,可能是V4。文章分析了代码仓库用途、新模型“露馅”原因,还从代码中发现Model1细节,结合论文梳理时间线,最后也提出了怀疑。

花叔
新闻资讯8

大模型记忆系统 MemOS 2.0:StarDust 技术演进与关键挑战|QCon 北京

4月16 - 18日QCon北京大会聚焦Agentic AI等前沿话题,记忆张量CTO李志宇将分享《大模型记忆系统MemOS 2.0:StarDust技术演进与关键挑战》,梳理技术演进,推出MemOS 2.0 StarDust,还分析实践痛点与演讲亮点。

InfoQ
8

上线不到一年,收徒百万,首个真人级AI导师技术底牌首次曝光

2025年初,与爱为舞落地国内首个真人级AI一对一导师产品「爱学」,上线不到一年有超百万学员使用。它突破传统AI教育局限,自研全栈技术体系,从多方面打造优质AI导师,为AI Agent规模化落地定义范式

机器之心
产品应用8

6000 字,学不会退网!藏师傅Trickle AI保姆级Vibe Coding高级通关攻略

作者歸藏分享用 Trickle AI 做 AIGC 周刊信息聚合网站的教程,介绍开发方法,如提示词书写、Magic Canvas 功能、Edit 模式修改、数据库搭建、页面美化、加搜索功能及上线设置等,还指出开发范式迁移趋势并提建议。

歸藏的AI工具箱
算法论文8

AI在线强化学习“边做边学”,斯坦福团队让7B小模型性能飙升,甚至超越GPT-4o

斯坦福等团队提出新范式AgentFlow,由四个智能体组成,用在线强化学习持续提升智能体系统推理能力。以Qwen - 2.5 - 7B - Instruct为基座模型的它在多基准测试表现突出,甚至超越GPT - 4o等大模型。

量子位
产品应用8

生产级Prompt自动化推理评估A/B实验结果的工程实践

本文围绕生产级Prompt自动化推理评估A/B实验结果展开,介绍系统背景与痛点,展示主Prompt和决策树,用deepseek - r1等模型推理。通过分析Bad Cases优化Prompt,总结设计原则和迭代方法,还给出通用启示与展望。

阿里云开发者
推荐文章7

AI泡沫原罪:英伟达是AI戒不掉的“毒丸”?

海豚君通过产业链核心公司报表研究AI投资是否到泡沫阶段及原罪。指出AI产业初期利润分配不均,上游获利多。还分析各环节风险,如英伟达怕需求下滑,云服务商有成本和产能风险,OpenAI成本高、亏损大。产业链巨头开始博弈定价权。

芯师爷
产品应用8

20亿美金苏度科技具身首秀即大招!0真机数据,zero-shot,跑出98%首次抓取成功率

苏度科技发布软硬件全栈自研的机器人系统R1,采用世界模型与强化学习一体化设计,在不使用真机数据的前提下,实现关键任务近100%的Zero-shot成功率。苏度团队通过重新定义数据范式,解决了具身智能发展的核心瓶颈。

量子位
算法论文7

MoE RL 实战:统一 FP8 全流程训练

SGLang RL 团队等实现 RL 全流程 FP8 训练与采样,消除训推不一致性。介绍 FP8 硬件基础、格式等,分析训练难点,定位 KL Loss 异常源于量化原理,验证其在 MoE 模型 RL 场景优势,指出模型规模与训推不一致的关联。

GiantPandaLLM
推荐文章7

上下文工程如何重塑智能体的“思考方式”?

文章指出在大模型时代,智能体能否理解上下文是关键。介绍了上下文工程的魔力、从提示词到上下文工程的演进,分析了上下文工程不等同于上下文的原因及常见失败类型,还给出编排设计和常见策略,最后提及用RAGFlow构建私有知识问答应用。

阿里云开发者