「数字人系统」共找到 2900 篇相关文章
Meta发布Omnilingual ASR:支持1600+语言的开源语音识别系统
Meta发布全新自动语音识别系统Omnilingual ASR,支持超1600种语言,核心创新是零样本和少样本学习能力,降低小语种语音识别门槛。项目提供不同规模模型,安装调用简单,目前仅支持40秒内音频,数据集和项目均开源。
Agent下半场!比Prompt更重要的是「上下文工程」,Anthropic首次系统阐述
Anthropic发文章阐述上下文工程,指出构建语言模型重点正从提示工程转向上下文工程,探讨了其与提示工程区别、重要性,给出实践指导原则、新趋势及应对长时程任务策略。
硬核拆解 OpenClaw:如何构建真正稳健的生产级 Agent 系统?【下】
本文延续上篇,继续拆解 OpenClaw 中 Agent 模块工程方法,涵盖安全与风险防御、记忆与状态管理、成本与效能优化、子 Agent 协作机制,介绍其方法并解读,指出企业场景需做取舍。
开源基金会:使用 Apache Iceberg 和 SparkSQL 构建可复制的 ML 系统
文章指出传统数据湖在机器学习工作负载的事务保证和版本控制方面表现不佳,而 Apache Iceberg 与 SparkSQL 结合,能带来数据库般的可靠性。文中介绍其优势、构建可重现特征管道方法、生产实施案例及相关最佳实践等。
深入体验 A2A SDK:一步步教你构建“服务化”的 Agent 系统
文章基于A2A最新Python - SDK,介绍将LangGraph的Agent通过A2A协议对外暴露并服务的方法,涵盖核心架构、概念、交互流程,以及A2A Server端、Client端实现和测试总结,还提及A2A优势。
清华艺博新展|具身之路:机器如何成为“人”
清华艺博将举办“具身之路:机器如何成为‘人’”展览,时间为2026年4月30日 - 5月6日。展览以“启思—看透—看懂—共创”为动线,呈现人形机器人发展历程,探讨智能与身体关系及人机共在问题。
12人团队打造AI陪伴神器,半年内斩获3000万美元投资
Tolan是今年2月上线的APP,公司仅12人。其虚拟形象可为用户提供情绪价值,下载超300万次,付费超10万。本月背后公司Portola完成2000万美元A轮融资,此前还有1000万美元种子轮。
把事实核查嵌入诊疗流程:MedGuard给「诊疗安全」当守门人
蚂蚁AI安全实验室与厦门大学团队联合提出MedGuard,将医学事实核查嵌入诊疗流程。它是医疗安全基础设施,在诊疗意见等形成前验证事实,在评测和临床评价中表现突出,能准确判断风险边界,可嵌入医疗流程。
北京798多觉工场开幕首展·《觉:数字艺术在中国》
2026年6月,北京798多觉工场开幕,首展《觉:数字艺术在中国》同期亮相。这是全球首个以“多觉艺术”为核心理念的实体空间,汇聚27位艺术家50余件作品,涵盖多种媒介,让观众调动感官,实现“艺术平权”。
集GraphRAG 和 DeepSearch于一体的智能问答系统graph-rag-agent
本项目结合GraphRAG与私域Deep Search,实现可解释、可推理的智能问答系统。亮点有从零复现GraphRAG、创新融合DeepSearch等,具备多模块功能,还有简单演示,地址https://github.com/1517005260/graph-rag-agent/blob/master/readme.md。