「响应测量」共找到 141 篇相关文章
让机器人「秒懂人话」!中国电信TeleAI发布首个实时文本驱动人形机器人控制框架TextOp
中国电信人工智能研究院(TeleAI)具身智能团队推出人形机器人TextOp通用小脑,首创流式文本驱动的实时小脑控制范式。用户发文本指令,机器人就能实时理解、无缝切换动作,在多场景有应用潜力。
Agent上下文工程被Cursor玩出了新高度~
Cursor的agent为所有模型使用动态上下文,在保持质量时更智能填充上下文。代码Agent改变软件开发方式,Cursor提出动态上下文发现模式,介绍了在其中使用该模式的做法及优势。
别再用单选评测骗自己了!Amazon新论文揭示了大模型在多选题中的3种系统性偏差
Amazon新论文揭示大模型做多选题有3种系统性偏差,如选择、数量、猜测偏差。还推出SATA - Bench评测,给出10个测量指标,提出Choice Funnel解码策略,能提升小模型多选题正确率。
深度拆解,硬核解构,揭开vLLM推理系统实现高效吞吐的秘籍
文章深度拆解 vLLM 推理系统,介绍其核心组件和高级特性,包括推理引擎流程、调度机制、高级功能等,还提及系统扩展、分布式部署、性能测量等内容,助力读者理解推理引擎工作原理。
OpenAI Codex彻底火了,4个官方前端提示示例给你
OpenAI Codex热度飙升,很多用户从Claude code转投其怀抱。它在响应式和移动端前端开发表现出色,文中给出像素游戏、工作管理平台等4个官方前端提示示例及中英文表述。
扩散语言模型写代码!速度比自回归快10倍
Inception Labs推出基于扩散技术的大语言模型Mercury,它突破自回归模型限制,生成速度快,还解决了难以回头调整的问题。实测显示其代码生成速度比传统工具最多快10倍,且有强大纠错能力,但面临与当前CI能力不匹配问题。
骨灰级克隆网站设计的开源项目
现在克隆网站设计常停留在截图和吸色,难以完全还原。designlang 项目用无头浏览器打开 URL,从实时 DOM 读取设计系统,输出多个文件,还能做到布局模式等其他提取器做不到的事。
3天狂揽23.1k星!把代码库变成知识图谱,AI编程成本降低35%
CodeGraph是开源本地代码知识图谱工具,提前为项目建索引,组织代码信息,让Agent直接查询。能减少token消耗与工具调用、提高响应速度,数据本地保存,还具备多语言支持等特点。
「你是专家」竟成AI幻觉毒药?新论文一巴掌揭穿提示词最大骗局
最新论文证实,「让AI装专家」会可测量、持续地降低模型的准确率。研究发现,Persona Prompting的效果依赖多因素,专家人设提升的多是「对齐感」。为解决问题,研究人员发明PRISM算法。
奥特曼深夜「放鸽子」!不发GPT-5,竟是给7亿用户「防沉迷」?
万众期待的GPT - 5未发布,OpenAI在ChatGPT周活破7亿时公布「防沉迷」新理念。这体现其「助你成事」目标,还对ChatGPT进行多项调整,且与全球专家合作提升其响应能力。