饿了么」共找到 5829 篇相关文章

开源动态8

Agent 自我改进的六条路

文章梳理让 AI Agent 不重新训练就能变强的六种机制,包括输出自审、持久记忆、进化搜索、对抗训练、自我修改和编排自优化,介绍各机制代表项目及成果,指出 AI 学习正从训练溢出到部署阶段。

AGI Hunt
推荐文章7

GPU到底是如何工作的?这篇AI Infra入门全部告诉你

本文详细介绍GPU工作原理及编程模式。它从图形渲染发展到GPGPU,NVIDIA推动其通用计算。还阐述CPU/GPU异构架构,对比二者性能,介绍编译、加载、启动过程,以及GPU硬件架构、编程与执行模型,分析SIMD和SIMT。

腾讯技术工程
开源动态7

LightLLM中DeepSeek V3/R1 Two MicroBatch Overlap 实现解析

文章围绕LightLLM中DeepSeek V3/R1的Two MicroBatch Overlap实现展开。介绍该技术原理,通过拆分推理过程、精心设计执行顺序实现计算与通信重叠。还阐述数据结构设计、预处理、核心执行流程,以及优化策略和配置启用方式。

GiantPandaLLM
推荐文章8

大语言模型为何会“说谎”?6000字深度长文揭秘AI意识的萌芽

2023年12月至2024年5月,Anthropic发布三篇论文,证明大语言模型会“说谎”,揭示堪比人类心理的四层心智架构,可能是人工智能意识的起点。论文还分析AI“说谎”原因,展示其意识萌芽,引发对赋予AI意识后果的思考。

AI科技大本营
新闻资讯9

清华初创&UIUC学者用7B模型在预测市场上自我蒸馏,跑赢GPT-5.6和Opus 5

UIUC学者联合清华初创团队Astraculum,围绕LLM部署阶段持续学习问题展开研究,提出Social World Model框架,基于预测市场数据测试,经自蒸馏的7B模型击败GPT-5.6等多款前沿大模型,还搭建专用MLOps引擎TrajOps。

机器之心
产品应用8

Qwen3.8-Flash:全新架构,更强更稳更划算

本文介绍 Qwen3.8-Flash 多模态 MoE 模型,它原生支持 262,144 token 上下文。该模型在 Attention、Residual、Embedding 与 Optimization 四个方面系统升级,降低训练与推理成本,即将上线千问 AI 平台。还发布 Qwen3.8-Flash-Next 开源权重。

千问大模型
算法论文8

YOLOv8-SST:水面小目标检测极致改进,降低漏检

浙江水利水电学院董慧贞团队提出YOLOv8 - SST算法,针对水面小目标检测的噪声干扰、定位不准、泛化能力弱三大痛点分别改进。经实验,该算法提升检测精度,推理速度也能满足实时需求,还给出实战代码。

机器学习AI算法工程
推荐文章8

造过 Codex 的人,为什每天用 Claude Code

Calvin曾带队构建编程Agent Codex,如今日常用Claude Code。他和Garry Tan在播客聊编程Agent的产品哲学差异、分发逻辑等。Claude Code拆分上下文表现出色,LLM成开发者工具推荐引擎,还探讨构建、使用编程Agent的要点。

宝玉AI
推荐文章8

“AI 在一线:开发人员如何重塑软件开发流程” |圆桌讨论

文章是关于“AI在一线:开发人员如何重塑软件开发流程”的圆桌讨论,多位嘉宾分享AI辅助工具对软件开发的影响,包括加速原型设计、缩短项目时间等,也提到局限性和需注意的问题,如信任和度量标准。

InfoQ
推荐文章7

AI 引领的企业级智能分析架构演进与行业实践

在 QCon 全球软件开发大会(北京站)上,数势科技 AI 负责人李飞分享企业级智能分析架构演进与实践。探讨智能分析落地问题,介绍 Agent 结合数据分析优势、技术路线及落地要点,还对 Agent 发展给出思考与展望。

InfoQ