「多代理场景」共找到 5455 篇相关文章
完全运行在浏览器中的全功能 3D 建筑编辑器无需 AutoCAD\Revit,也无需每年 5,000 美元的授权费用,100%开源免费
Pascal Editor是完全在浏览器运行的3D建筑编辑器,开源免费,无需AutoCAD、Revit及高额授权费。它采用节点式场景结构,有多种特性,技术栈丰富,分层设计让核心逻辑可复用,性能优化亮点多。
美团之后,京东也开始自研大模型了
京东发布JoyAI - LLM Flash模型,激活参数小、推理快。它采用混合专家架构等技术,在基础架构、数据加工、强化学习等方面表现出色,还通过多Token预测等技术加速推理,为商业场景落地扫清障碍。
离职特斯拉“隐身”14个月,杨硕创业终于亮牌:重新定义机器人训练范式
杨硕从特斯拉擎天柱团队离职创业一年多后,妙动科技团队带来新论文《DiT4DiT: Jointly Modeling Video Dynamics and Actions for Generalizable Robot Control》。该团队用视频训练机器人动作,提出DiT4DiT模型,解决VLA模型不懂物理问题,在人形机器人上有新突破。
上海一群青年,造了个学术版OpenClaw
上海科学智能研究院联合复旦大学发布超级科研合伙人“大圣”,它是面向科学探索的高能动性智能体。能在生命、地球、人文等多领域发挥作用,其研发涉及多模态模型、群体记忆架构等核心技术,还介绍了相关赛事。
OpenAI 发布新的 Codex 桌面版,我现在不骂 Codex 难用了
OpenAI发布Codex Desktop App,是macOS桌面应用。它有图形界面,支持定时任务、Skills管理和多Agent并行运行。还对比了与Claude Code的差别,介绍了OpenClaw项目,最后说明不同用户的使用场景和用量定价。
Skills的最正确用法,是将整个Github压缩成你自己的超级技能库。
文章指出重复造轮子不可取,Skills可将Github开源项目封装成技能库。以FFmpeg、yt - dlp等为例,介绍封装流程,还提及多场景应用,如视频下载、格式转换等,让普通人能利用开源成果。
TinyAI :全栈式轻量级 AI 框架
TinyAI是用Java实现的全栈轻量级AI框架,具有教育友好、模块化等特点。它分层设计,涵盖数学运算、神经网络等模块,支持多种模型架构与并行训练,还有智能体系统,可用于多领域,未来规划丰富。
北大 & 作业帮团队提出 Text-to-SQL 新框架 Interactive-T2S,攻克宽表处理与低资源对齐难题
北大与作业帮联合研发的论文提出 Interactive-T2S 框架,将 LLM 塑造成智能代理,通过多轮交互解决传统 Text-to-SQL 方法在宽表处理、低资源对齐等方面的难题,已入选国际顶会 CIKM2025。
将数据优势发挥到极致:「杭州六小龙」开源搭建空间智能的第一步
大模型时代数据支撑至关重要。群核科技在首届TechDay为空间智能发布空间语言模型SpatialLM 1.5和空间生成模型SpatialGen,前者学会空间语言,后者实现场景多视角图像生成且具时空一致性,SpatialGen已开源。
轻量级易开发,8B参数释放大实力!科学多模态模型Intern-S1-mini开源
上海人工智能实验室继7月26日开源后,推出轻量化版本Intern-S1-mini。它是8B参数“迷你模型”,兼具通用与专业科学能力,适合快速部署和二次开发,在多方面表现出色,还降低了对高端计算设备依赖。