「多智能体框架」共找到 7334 篇相关文章
看完智平方创始人郭彦东的这场演讲,我对 VLA 又有信心了
2026年具身智能赛道技术路线引争论,“VLA时代终结”论调扩散。智平方创始人郭彦东演讲回应,称VLA时代未终结,世界模型汇入VLA,关键变量是类脑架构,智平方技术成果和开源平台也证明VLA有生命力。
Transformer创新架构SALA:上下文更长,推理更快
面壁智能发布行业首个大规模训练的稀疏 - 线性注意力混合架构 SALA 及文本模型 MiniCPM - SALA。该架构降低推理开销与显存占用,MiniCPM - SALA 在长文本处理及推理上表现出色,还发起大奖赛探索性能极限。
字节开源GUI Agent登顶GitHub热榜,豆包手机核心技术突破26k Star
字节开源的豆包手机核心支撑GUI Agent模型UI - TARS登顶GitHub热榜,突破26k Star。它是多模态AI智能体,纯视觉驱动,部署简单,历经多轮迭代,成为热门开源多模态Agent。
Vercel 开源 Bash 工具:基于本地文件系统的上下文检索
Vercel开源bash - tool,为AI智能体提供Bash执行引擎,让其通过shell命令在文件夹操作获取上下文,有三大核心操作,部署灵活,可节省token,贴合Unix工作流,或影响未来AI开发系统处理本地上下文方式。
AI月产十亿行代码,暴增76%!程序员论坛炸锅:代码行数≠生产力!
Greptile基于每月用AI审核的十亿行代码发布AI编程年度报告,显示AI助力下代码生产量飞涨,但论坛对此多存怀疑,还分析了不同大模型SDK下载量、模型适配场景等,也给出2025年关键论文。
1人1假期,肝完10年编程量!马斯克锐评:奇点来了
硅谷大佬新年收假分享编程Agent提效成果,Midjourney创始人假期编程量超过去10年,马斯克称进入奇点。多位工程师也有类似体验,Claude在编程方面表现出色,国产字节TRAE中国版SOLO全量免费开放。
任意骨骼系统的模型都能驱动?AnimaX提出基于世界模型的3D动画生成新范式
传统3D动画制作依赖骨骼绑定与关键帧编辑,成本高。现有自动化方法有局限。北京航空航天大学团队提出AnimaX框架,结合视频扩散模型与骨骼动画优势,支持任意骨骼拓扑,生成动画质量高、速度快,泛化能力强。
社区供稿 | 开源SOTA:阶跃发布端到端语音大模型Step-Audio 2 mini!
阶跃星辰发布最强开源端到端语音大模型 Step - Audio 2 mini,在多个国际基准测试集获 SOTA 成绩。它统一建模语音理解等,率先支持语音原生 Tool Calling 能力,架构创新,案例展示其多方面强大能力。
颠覆互联网的下一波浪潮:Agentic Web来了!
本文介绍全新范式 Agentic Web,它由 AI 智能体组成,用户发目标,AI 自动完成任务。文章从多方面解析这场范式革命,还阐述应用场景、面临挑战,指出其是互联网重大转折,但落地需解决诸多难题。
利用大模型从开源情报中自动提取检测规则:LLMCloudHunter,有开源
随着网络攻击增加,威胁情报成主动安全关键。以色列本古里安大学发布LLMCloudHunter框架,用大模型从开源情报自动生成检测规则,评估显示其规则质量高,且大部分能编译成Splunk查询,软件已开源。