「统一模型架构」共找到 8756 篇相关文章
网络顶会获奖!华为提出端网协同RDMA传输架构,解决大规模AI集群网络可扩展性问题
全球网络通信顶会 ACM SIGCOMM 2025 落幕,华为与港科大合作的 DCP 研究成果获奖。该论文提出数控分离传输架构 DCP,解决大规模 AI 集群网络可扩展性难题,实验显示其性能优于现有 RDMA 方案。
论文深度解读:大模型(LLM)加持下的自主无人机分层智能体框架,实现自主规划
文章解读《A Hierarchical Agentic Framework for Autonomous Drone-Based Visual Inspection》论文,介绍分层智能体框架让无人机群自主规划。研究对比三种‘思考模式’与不同‘大脑’组合,还指出未来研究可开发混合系统、混合能力智能体及自适应系统。
开源RAG又添新军!港大开源多模态RAG神器,多文档格式统一解析、知识图谱索引与混合检索!
在AI信息检索领域,传统RAG系统难处理复杂文档。港大数据智能实验室开源RAG - Anything,可提供端到端解决方案,能多格式解析、构建知识图谱和混合检索,优势显著。
Claude团队用Qwen测试全新训练方法
Anthropic最新研究提出中训练(MSM),在预训练后、后训练前给AI立规矩。实验显示,新增MSM能让通义千问两款32B大模型失准率大幅下降,还能精简微调数据。MSM与对齐微调结合,可提升模型泛化能力。
千问模型预览版杀到全球第6,马斯克称中国将赢得地球上的AI竞赛!
LMArena更新榜单,阿里千问新旗舰预览版获1464分,全球排第六、中国第一。阿里在全球大模型实验室排第五,全球前十中有五家中国公司。千问3.5预览版表现出色,正式版值得期待。
RL在Agentic Reasoning中的作用:拨开迷雾,看清本质
近年大语言模型在推理任务能力惊人,但使用外部工具存挑战。传统SFT无法让模型自主调用工具,强化学习虽被引入,但在智能体推理中面临训练效率、稳定性和泛化能力难题。论文从多维度解构智能体强化学习,提出有效方法。
密室逃脱成AI新考场,通关率不足50%,暴露空间推理短板丨清华ICCV25
清华大学团队受密室逃脱游戏启发,提出EscapeCraft:一个3D密室逃脱环境,用于评估多模态大模型在视觉环境中完成复杂任务推理的能力。该论文已入选ICCV 2025。研究评测了多个热门模型,发现它们在推理和探索行为方面存在诸多问题。
搜狗输入法,居然还在更新??
在腾讯微信输入法上线、各类AI新产品轰炸的当下,搜狗输入法进行20.0 AI大版本升级。它有AI文本翻译、轻声识别等功能,用AI大模型全面重构,还接入腾讯混元、DeepSeek R1大模型,免费提供AI服务。
高性能计算群星闪耀时
本文介绍了高性能计算(HPC)在大模型时代的重要性,以及清华高性能计算团队在HPC及相关领域的研究与实践。如郑纬民带领团队突破存储技术,陈文光、翟季冬等助力大模型训练,武永卫团队优化推理,张悠慧探索类脑计算。
琶洲模方亮剑:第四届琶洲算法大赛大模型前沿技术分论坛暨琶洲模方孵化项目展示圆满举办 | 甲子光年
9月23日,「第四届琶洲算法大赛大模型前沿技术分论坛暨琶洲模方孵化项目展示」举办。活动汇聚各界精英,展示琶洲AI产业化成果。清智·琶洲模方首批孵化成果亮相,还有主题演讲、签约仪式等,最后AI问辩将气氛推向高潮。