「小模型推理能力」共找到 9427 篇相关文章
Vibe Coding 在代码生成与协作中的实践与思考
本文整理自阿里专家向邦宇的分享。探讨构建 Vibe Coding 工具,介绍其分类、在阿里现状。指出用户使用中面临代码质量等问题,产品自身有设计、安全挑战。还分享 Agent 建设经验,强调适配国产模型及模板化的作用。
即梦图片4.0来了,我整理了10个好用到爆的进阶玩法。
字节即梦图片4.0背后是seedream4.0模型,与NanoBanana性能相当,但支持直出4K图、自由控比例、文生图审美和可控性强,中文字生成领先。文章整理了它在虚拟模特、换装等10个方面的玩法。
图解Vllm V1系列5:调度器策略(Scheduler)
本文是图解Vllm V1系列5,聚焦调度器策略。先回顾vllm v1整体运作流程,接着阐述调度 - 推理的整体流程,包括将请求添加进Scheduler、Scheduler单步调度策略等,还对比了不同场景下的函数及调度逻辑。
一年拿下三轮融资!影目INMO正在鼻梁上“复刻”一个AI手机
影目INMO在一年拿下三轮融资,近5亿资金到位。其产品INMO GO3等表现出色,首发预订量可观。该公司专注轻量化一体式AI+AR眼镜,结合自研系统与智谱大模型,还拓展线下渠道,全球化布局也在推进。
万字实录:VLA 范式,具身智能的曙光与迷雾丨GAIR Live
2025年5月9日,雷峰网等举办“具身智能之VLA的实践与突破”线上圆桌沙龙。多位专家探讨VLA定义、起源、技术路线等,指出其面临推理、数据等瓶颈,还讨论了与强化学习结合、数据选择、提升泛化性、长程任务及落地场景等问题。
“OpenClaw 类”自进化智能体代表项目介绍
文章指出传统 Agent 存在记忆短暂、能力固定的瓶颈,介绍了 OpenClaw 生态中“自进化”的不同形态,还列举了 Nanobot、AutoResearchClaw 等多个代表性项目,阐述其特点和应用场景,最后抽象出自进化智能体的共同要素和工程模式。
2026 年做搜索就是做 Agent Memory
本文整理自Elastic全球副总裁肖涵演讲,讲述AI搜索发展历程,指出2026年做搜索基本是做智能体记忆。分析智能体记忆痛点、表征、遗忘等问题,介绍Jina AI相关模型,梳理记忆产品分类与工作流,给出行业观点与建议。
7 小时连续重构不掉线!一骑绝尘的Claude 终于遇到对手:Greg Brockman亲自解读AI编程重大突破
9月16日,OpenAI推出新模型GPT-5-Codex,专为AI辅助编程工具设计。它在代理编码基准测试中表现佳,形成了覆盖各种需求的交互界面,还具有更优的后训练特性,能连续工作7小时完成复杂重构。
GPT-5败下阵,这款中国AI拿下全球第一,众多医生已在用它做诊断
国家卫健委推进“人工智能+基层应用”,基层医生需实用AI助手。未来医生AI工作室的MedGPT在临床“安全”与“有效性”评测击败国际知名大模型夺冠,其两款助手获医生认可,被视为AI赋能基层医疗最佳实践。
深度揭秘OpenAI如何让GPT-5「技术性」超越Claude:悄悄跳过最难的23道题
OpenAI发布会上称GPT-5代码能力全球第一,其在SWE-bench Verified基准获74.9%通过率,略高于Claude Opus 4.1的74.5%。但OpenAI未做23道难题,若计入,GPT-5实际通过率或低于Claude。