国科大」共找到 5137 篇相关文章

新闻资讯7

CSDN 创始人蒋涛:“码盲”消失,新程序员崛起

CSDN 创始人蒋涛在会演讲指出,从传统互联网到 AI 是底层变迁,要翻越美国‘三座山’实现从 Global AI 到 Local AI。他预言‘码盲’将消失,新程序员崛起,AI 还能重写硬件,中国机遇

AI科技大本营
开源动态8

银河通用X清华学发布业内首款开源人形机器人全身遥操系统OpenWBT,支持多机型、跨虚实,小时内可轻松部署

银河通用与清华学合作发布全开源人形机器人全身遥操作系统OpenWBT,新手小时内可部署。该系统有极简部署、多机型跨平台、兼顾虚实遥操三亮点,背后技术解决了sim2real迁移难题。

机器之心
开源动态7

重磅!中国团队发布SRDA新计算架构,从根源解决AI算力成本问题,DeepSeek“神预言”成真?

国内玉盘AI团队发布《SRDA AI模型专用计算架构》白皮书,提出全新SRDA计算架构,从硬件源头解决AI算力成本瓶颈。它以数据流为核心,在内存、网络等方面创新,为开发者带来高效、低成本等价值。

InfoQ
开源动态8

万帧?单卡!智源研究院开源轻量级超长视频理解模型Video-XL-2

长视频理解是多模态模型关键能力,当前开源模型有短板。智源研究院联合发布 Video-XL-2,多维度优化长视频理解能力,还设计效率优化策略,在主流评测基准表现出色,有广泛应用潜力。

机器之心
算法论文7

全面评估多模态模型视频OCR能力,Gemini 准确率仅73.7%

MME - VideoOCR团队评估多模态模型(MLLM)视频OCR能力。构建精细任务体系和高质量数据集,评测18个主流MLLM。即便如Gemini - 2.5 Pro,准确率仅73.7%,暴露出MLLM在视频OCR领域能力局限。

量子位
推荐文章7

从零开始200行python代码实现LLM

文章从传统思路出发,用Python实现极简语言模型,介绍从零基础到Bigram模型的过程,包括词汇表、模型训练推理等内容,还讲解了PyTorch基础,最后实现pytorch版Bigram模型,后续将实现完整GPT。

阿里云开发者
开源动态8

太顺手啦,这款开源框架让AI助手秒级接入应用,狂揽20.5K星!再见繁琐AI开发

CopilotKit是基于React的开源框架,开发者能以极简代码将智能助手集成到Web应用。它有三分钟集成、场景感知等优势,具备五核心功能,适用于多场景,三步即可入门,比同类项目更有优势。

小华同学ai
推荐文章7

MCP技术浪潮中的Agent应用开发新范式

当下,MCP迅速发展重塑AI开发协作生态。太极平台借MCP汇聚多方能力,释放模型潜能。文章介绍MCP技术、执行细节,探讨其与Agent、Function Calling关系,分析技术生态,还思考了MCP发展变化与局限。

腾讯技术工程
产品应用8

极客说|AI Sales Avatar 探索

本文介绍名品车AI数字导购Vendy搭建过程,以TEN平台为中枢,集成Agora、Azure等五平台,构建具备听、说、想、演能力的AI数字销售助理,还给出后续扩展建议,推动企业AI转型升级。

AIGC开放社区
算法论文8

ACL 2025 高分接收 | 高感情语音技术:逻辑智能小语种TTS破局之道

语音合成技术在语种发展好,但小语种因语料稀缺等面临挑战。逻辑智能团队提出针对低资源语言TTS的解决方案,构建泰语数据集,经先进预处理,其TTS模型效果好,有零样本克隆能力。

机器之心