「可验证评分机制」共找到 1672 篇相关文章
将思维链(CoT)引入具身世界,哪种路径能真正打通机器人「知行合一」?
文章围绕将思维链(CoT)引入具身智能领域展开。介绍CoT从语言层面到成为机器人行为核心认知机制的转变,分析分层架构与端到端模型两种技术路径,还阐述自变量机器人统一架构的优势和能力。
刚刚,1122人干出“国产GPU”第一股,摩尔线程成功IPO:开盘股价疯涨,市值破2800亿!专家:国产AI芯片商业化进入关键期
今日摩尔线程在科创板上市,发行价114.28元,截至发稿股价涨至620元/股,市值破2800亿。它成立于2020年,核心团队多有英伟达背景,研发投入高,已推出四代GPU架构和产品,专家称国产GPU进入商业化验证阶段。
预算有限、技术空白:最刁钻的AI用户,是中小企业老板
2026年大模型在中小企业办公环境中应用不佳,工具与场景脱节。华为云推出专为中小企业的Flexus AI智能体平台,它依托自研模型,在多场景准确率领先,已在多行业验证效果,还能辅助内容创作。
万字长文!大模型LLM推理优化技术总结
文章围绕大模型LLM推理优化技术展开,先介绍LLM推理各阶段、批处理、KV缓存等概念及内存需求,再阐述模型并行、注意力机制优化、模型优化和模型服务等技术,如Pipeline并行、MQA、量化、动态批处理等。
SGLang JIT Kernel 介绍
文章介绍SGLang JIT Kernel,此前开发CUDA Kernel流程繁琐、编译时间长,现基于TVM - FFI探索JIT开发加速迭代。文中梳理其机制、抽象及新增Kernel流程,还给出环境设置、目录结构等内容,并以实例说明开发过程。
PyTorch博客翻译 Accelerating Generative AI Part III: Diffusion, Fast
这篇博客介绍用纯原生 PyTorch 技术将文本到图像的 diffusion 模型(特别是 Stable Diffusion XL)推理速度提升高达 3 倍的方法,讲解五种优化技术,还验证了方法在其他 diffusion 模型上的通用性和有效性。
Anthropic CEO:模型可在一亿上下文窗口中学习,且不改变权重,未来AI将每月10万美元
Anthropic CEO Dario Amodei预测几年内将出现月费10万美元、支持1亿词上下文窗口的AI模型。Google Research论文揭示LLM能在不改变权重下,通过「临时便签」机制学习,还介绍了其原理与实验验证。
手把手带你构建第一个业务本体(Ontology):为 Agent 绘制业务地图。
文章介绍为企业AI Agent构建业务本体,阐述Agent需本体的原因,讲解TBox与ABox概念。给出构建流程,介绍RDF/OWL标准及Protégé等工具,实战构建‘订单加急交付’本体并验证,还演示Python程序推理,展望本体应用场景。
OpenAI也缺卡!僧多粥少,自曝内部抢卡抢到发疯
OpenAI正面临绝对的算力稀缺,总裁Greg Brockman自曝内部算力资源争夺严重。算力是创新根本驱动力,因资源有限,许多产品无法发布,如ChatGPT Pulse部分功能仅对Pro用户开放。OpenAI有资源分配机制,但平衡各团队需求不易。
OpenAI重大发现:GPT-4b micro改造诺奖研究,山中因子重编程效率提高50倍
OpenAI与Retro Bio合作,用新模型GPT - 4b micro设计出新型山中因子变体,使重编程效率提高50倍。此前山中因子重编程效率极低,限制其应用,此次改进是突破。研究还在多方面验证了变体效果。