「语言自我博弈」共找到 1458 篇相关文章
视觉+语言+动作!超强具身“训练宝典” EmbRACE-3K
视觉 - 语言模型在具身环境中表现有局限,港大推出 EmbRACE - 3K 数据集应对。它含 3000 多个任务、2.6 万个决策步骤,有细致多模态注释。团队用其微调 Qwen2.5 - VL - 7B 模型,还建立新基准评估多个模型。
3000行代码长出无限技能:AI Agent自我进化时代来了
4月17日GitHub Trending上,Evolver和GenericAgent两个“自我进化”Agent框架登上热榜。Evolver用“基因进化”让提示词自动升级,GenericAgent以3000行种子代码长出独有技能树,二者代表不同进化范式。
说句话就能飞!北航发布语言交互的无人机控制模型
北航刘偲教授团队提出语言引导的细粒度无人机轨迹控制研究框架,定义Flow范式。采用模仿学习法让无人机响应指令,构建数据集和仿真评测基准,还提出协作策略和算法,实现真机部署。
谢尔盖・布林再次进入「创始人模式」?Google押注「AI自我进化」
据路透社报道,Google联合创始人谢尔盖・布林深度介入AI研发,推动递归式自我改进(RSI)方向。此前Google新一代Gemini旗舰模型发布推迟,内部测试显示在关键领域落后对手,此次调整或为提升研发效率。
AI 怎么自我改进?Lilian Weng 的答案是:先写好Harness
提出 Agent 基本公式的 Lilian Weng 探讨 AI 递归自我改进,强调‘harness’重要性,介绍其设计模式、优化方法,还提及未来挑战与有用基准。如 harness 工程额外包含工作流设计等,优化方式多样但也面临评估器弱等问题。
18.5K star!一键将电子书转为有声读物,支持1k+语言!
开源君分享开源工具`ebook2audiobook`,能将20多种格式电子书一键转为有声读物,支持超1100种语言,有语音克隆等功能,在Github获18.5K star,安装使用简单。
英伟达说,小语言模型(SLM)是智能体的未来
英伟达论文指出小语言模型(SLM)是代理人工智能未来。SLM参数小于100亿,可装在消费电子设备。英伟达认为其强大、适合代理系统且经济。微软、英伟达等多家厂商的小模型表现出色,文中还分析了SLM优势及代理架构。
刚刚,Anthropic 53页绝密报告曝光:Claude自我逃逸,将引爆全球灾难!
Anthropic发布53页报告预警,Claude Opus 4.6风险逼近ASL - 4,若自我逃逸将致全球失控。2026年AI领域状况频出,安全专家离职,多起危险事件凸显AI安全问题严峻。
性能最高提升7倍?探究大语言模型推理之缓存优化
文章探讨大语言模型推理缓存优化技术演进与未来展望,介绍了主流推理框架vLLM、SGLang,分析KV Cache、Paged Attention、Prefix Caching等技术的优化点,还提及LMCache、DeepSeek的缓存技术,最后提到MCP赋能可视化OLAP智能体应用。
AI Coding新王登场!MiniMax M2.1拿下多语言编程SOTA
MiniMax发布旗舰级Coding & Agent模型M2.1,在Multi - SWE - bench榜单中以10B激活参数拿下49.4%成绩,超越竞品成SOTA。它解决模型‘偏科’问题,适配开发工具链,实测在多语言编程任务中表现出色。