「多LLM系统」共找到 5917 篇相关文章
DeepMind华人研究员Lun Wang离职,「评估」成制约模型能力飞跃的瓶颈
谷歌DeepMind研究员Lun Wang离职后发文指出,当下评估体系难以应对新模型,制约模型能力飞跃。现有评估多针对当前模型,新能力出现时往往无法预测,需构建能自我进化的评估系统。
拯救大模型的逻辑短板:Nature文章预测符号主义AI与神经网络的联姻将引爆下一场技术革命
结合逻辑系统与神经网络成AI热门趋势,神经符号AI崛起,旨在弥补神经网络短板。虽面临技术挑战,但已在多领域展现潜力,不过也有质疑声,其发展仍面临诸多难题。
爬虫界“瑞士军刀”!开源高性能爬虫工具,实施进度监控、全栈SDK支持、n8n深度集成!
在AI驱动的数据时代,WaterCrawl是基于Python和Scrapy的开源网页爬虫工具,专为大规模数据提取和LLM优化设计,支持多语言内容抓取、实时进度监控和深度AI平台集成,优势显著。
字节跳动Seed1.5-VL复杂图表精准抽取,Deep Think是多模态未来的主流
文章介绍字节跳动的Seed1.5-VL模型,它能精准抽取复杂图表,处理模糊图片、推理几何题。其由视觉编码器和LLM组成,预训练语料丰富,后训练结合多种方法,推荐在huggingface体验。
GitHub爆款神器 | IOPaint:21.7k star 开源AI图像修复项目,竟能秒删水印、拓展画幅!
IOPaint 是 Sanster 团队出品的开源图像处理工具,集 SOTA AI 模型于一体,支持图像擦除、对象替换等功能,还支持多平台部署,能解决旅游照、电商图等处理痛点。
深度体验|京东开源轻量化通用Agent产品 jdgenie,开箱即用!二次开发及踩坑指南。
本文体验京东开源的端到端多智能体系统JoyAgent - JDGenie,它是产品级多智能体协同系统,开箱即用、支持本地部署。介绍其原理架构、本地部署测试步骤、二次开发方式,还指出特点与不足。
通义实验室新研究:大模型自己「扮演」搜索引擎,提升推理能力无需搜索API
阿里通义实验室开源ZeroSearch,提供无需与真实搜索引擎交互的强化学习框架。它用模拟搜索环境和渐进式抗噪训练,让LLM自给自足,节省API成本,在多问答数据集表现优,为智能化检索提供新思路。
AI驱动的开源攻击框架:HexStrike-AI
HexStrike-AI是安全研究员开发的开源攻击框架,2025年7月起在GitHub免费提供。它基于MCP协议,集成LLM与150多种工具,可自动化渗透测试和漏洞发现。曾被网络犯罪分子利用,能加速攻击流程,展现强适应和并行化能力。
Discrete Tokenization:多模态大模型的关键基石,首个系统化综述发布
近年来,人们关注将LLM能力扩展至非文本模态,Discrete Tokenization成关键方案。但现有研究缺系统总结,香港科技大学等团队发布首个相关系统化综述,梳理技术脉络、方法及挑战,给出未来研究方向。
本周推荐的6个超级6的Github开源项目!
本文推荐6个Github开源项目,有能接入多平台的开源微信机器人CoW,基于VS Code魔改的AI代码编辑器Void,免费的ERP系统ERPNext,开源物联网平台ThingsBoard,共享虚拟浏览器Neko,微软轻量命令行编辑器Edit。