多角色架构」共找到 5586 篇相关文章

算法论文8

SceneSplat: 基于3DGS的场景理解和视觉语言预训练,让3D高斯「听懂人话」的一跃

文章引入 SceneSplat,首个在 3DGS 上原生运行的端到端大规模 3D 室内场景理解方法,提出自监督学习方案,构建发布 SceneSplat - 7K 数据集,在个实验中达 SOTA 效果。

机器之心
新闻资讯8

我国科研团队,突破了存算一体技术瓶颈

AI浪潮倒逼半导体产业创新,存算一体技术应运而生。但该技术应用存在问题,排序难题制约其发展。北大团队国际首次实现基于存算一体技术的高效排序硬件架构,成果发表在《自然∙电子》。

芯师爷
新闻资讯8

SGLang 推理引擎的技术要点与部署实践|AICon 北京站前瞻

SGLang 是开源推理引擎,截至 2025 年 6 月,GitHub 近 15K Stars,月均下载量超 10 万次,被个行业巨头采纳。InfoQ 专访其核心开发者尹良升,他分享关键技术等内容,6 月 27 - 28 日他将在 AICon 演讲。

InfoQ
算法论文8

超越Claude Mythos和GPT-5.5!斯坦福Agent验证框架拿下SOTA,Transformer作者转发

斯坦福、伯克利与英伟达联手打造LLM-as-a-Verifier验证框架,该方法是通用验证机制,可与任意Agent Harness和模型结合。研究表明扩展验证阶段计算量,能提升Agent整体性能,在基准测试中超越Claude Mythos和GPT - 5.5。

量子位
开源动态8

清华开源教育龙虾,沉浸式互动课堂,运行成本仅为传统的千分之一

清华大学团队将校内验证两年的AI课堂系统OpenMAIC开源。它能把主题或文档转化为互动课堂,运行成本仅为传统MOOC的千分之一。有种组件,智能体协作,还支持种大模型,已获学生积极反馈。

AIGC开放社区
开源动态8

音频全能王炸!小米MiMo-Audio开源,力压Gemini/GPT-4o!

小米团队开源通用音频大模型MiMo-Audio,集种功能于一身,支持7国语言零样本克隆和中英混合合成。首包延迟低,效果自然稳定。在个基准测试中表现优于Gemini-2.5-Flash和GPT-4o-Audio。

开源星探
推荐文章7

AI时代的求生法则

文章指出AI时代逻辑改变,它淘汰工具人而非仅淘汰旧工具。以编程工具进化为例说明AI智能化、自动化提升,影响个行业。作者悲观看待普通人命运,给出三条求生法则:用先进AI工具、Vibe Coding、投资AI。

newtype AI
算法论文8

Auto-Research「终极大考」:新基准撕下大模型科研伪装

来自所高校的研究者提出MLS - Bench,用于解决现有Auto - Research评测的归因问题。它含140个真实研究任务,校准受控修改范围,主实验显示当前模型在方法发现上有明显缺口,Auto - Research需更严格评测标准。

机器之心
开源动态8

腾讯混元开源世界模型!2.0版本一键生成3D空间,游戏关卡随心造

4月16日,腾讯正式发布并开源混元3D世界模型2.0(HY - World 2.0)。它是模态模型,能理解种输入,自动生成、重建和模拟3D世界,支持格式3D资产导出,可与游戏工作流对接。

量子位
产品应用8

实测腾讯云 AndonQ:号称比肩原厂技术专家的 “领域虾”,到底有能打?

文章实测腾讯云 AndonQ,它号称全球首款 ITSM“领域虾”,可适配主流“虾”类工具,集成至 IM Bot。测评显示其成本低、上手轻量,在架构选型、故障排查等场景表现出色,将 ITSM 体系浓缩到对话框。

AI前线