「可扩展监督」共找到 4374 篇相关文章
个人音频转录与交互神器
Speakr是个人自托管网络应用,可转录音频、生成摘要和标题,还能通过聊天互动。支持音频上传、浏览器录音等功能,可选择不同转录方式,有简单和高级两种安装方法。
西交大提出QQWorld:仅需10行代码,世界模型成功率提升5.33个百分点
2026 年 3 月 Yann LeCun 等人提出 LeWorldModel,西安交通大学研究团队发现其存在问题,进而提出 QQWorld,用分位数—分位数匹配替换原有的 EP 正则,提升了规划成功率,还提出 Cross - Batch QQ 解决显存问题。
100%开源!吴恩达做了个个人桌面Agent
AI教育大佬吴恩达推出开源项目OpenWorker,这是个个人桌面Agent,能跨工具干活。它主打开放、本地优先、隐私保护和模型无关,目前可在Mac运行,Windows版本待完善。
夯,开源 LiteParse,没有对手的 PDF 解析工具,知道的太晚了!
LlamaIndex团队开源独立工具LiteParse,用Rust打造,可本地运行、零成本、高精度解析PDF。它能提取文本及精确位置,有多种输出格式,支持多格式输入,还介绍了安装、使用、OCR配置等内容及应用场景。
美团提出全新多模态统一大模型STAR,GenEval突破0.91,破解“理解-生成”零和困局
近日美团推出多模态统一大模型 STAR,以“堆叠自回归架构 + 任务递进训练”实现理解与生成双重突破。它解决行业痛点,通过三大核心设计统一能力,实验在多任务中表现顶尖,还给出后续探索方向。
Clawdbot为何大火?
LLM记忆问题是业界难题,Clawdbot采用极简方式破解,用写Markdown实现记忆。其记忆系统优势明显,如极简易用、透明可控等,但也有劣势,像数据扩容能力有限、功能扩展性不足等。
AI 代码审查再进化:AutoDev 多智能体协作架构深度解析
现代软件开发中,代码审查存在信息割裂、人工效率低等痛点。AutoDev 借助多智能体协作与信息聚合,实现从分析到修复的闭环智能流程,还构建多 Agent 协作体系,未来将集成更多能力。
Claude Opus 4.5来了:谷歌把Anthropic逼到了墙角
上周谷歌发布Gemini 3 Pro表现惊艳,今日Anthropic推出Claude Opus 4.5应对。其编程能力强,SWE - bench Verified首超80%,且降价66%。还推出产品更新,开发者可按需选模型。
开源即登榜!登顶全球前十AI编程智能体,UCL初创团队开源Prometheus
UCL初创团队EuniAI开源AI软件智能体Prometheus,在SWE - bench Verified上Pass@1达71.2%,成绩入官方主榜。它有图结构推理设计,能理解代码,成本低,官网有Demo展示其工程化能力。
首个MCP架构、只50行代码就能实现高效RAG的开源框架UltraRAG 2.0
检索增强生成系统(RAG)复杂度提升,使科研人员面临高昂工程实现成本。清华大学、东北大学、OpenBMB等联合推出UltraRAG 2.0,基于MCP架构,降低技术门槛与学习成本,让科研专注创新。