「大模型架构」共找到 9827 篇相关文章
36个月大逆转!他带着谷歌AI杀回来了,下一步世界模型
ChatGPT发布近36个月,哈萨比斯带领谷歌AI反攻,新发布的Gemini 3在多模型榜单登顶,表现优于GPT - 5。谷歌将其作为底层模型开放,增强现有产品,还考虑重启谷歌眼镜项目。谷歌正缩小与OpenAI差距,哈萨比斯预计5 - 10年实现AGI。
爆冷!字节Seed 在CCPC 决赛只做出一道签到题,而DeepSeek R1 直接挂零?
第十届 CCPC 举行,字节 Seed 携 Seed - Thinking 参赛,仅做出一题,DeepSeek R1 挂零。不同模型架构在比赛中差异不大,暴露出大模型做算法题短板,推理模式模型表现更好。
1万4颗星!机械臂可以接大模型了!面向真实世界机器人的尖端人工智能LeRobot
LeRobot 为 PyTorch 中真实世界机器人提供模型、数据集和工具,降低入门门槛。包含尖端方法,已提供预训练模型等,未来将增加真实机器人支持,文中还介绍其安装、使用等内容。
北大王选所彭宇新团队:让多模态大模型学会「看懂物种关系」丨CVPR 2026
北大王选所彭宇新团队在论文中提出TARA方法,引入生物分类学知识与多模态模型中间表征对齐。实验显示,TARA能提升模型层级识别和未知类别识别能力,还可加速训练收敛,计算开销小。
搜狗输入法,居然还在更新??
在腾讯微信输入法上线、各类AI新产品轰炸的当下,搜狗输入法进行20.0 AI大版本升级。它有AI文本翻译、轻声识别等功能,用AI大模型全面重构,还接入腾讯混元、DeepSeek R1大模型,免费提供AI服务。
用155万模拟视频给模型上课!GVE模型一次学会9种视频检索技能
当前视频检索研究陷入困境,现有模型难以应对复杂检索需求。香港科技大学(广州)联合阿里巴巴通义实验室推出通用视频嵌入模型GVE,其在零样本设置下超越14个主流模型,全链条创新为视频检索通用化奠定基础。
企业数字化转型新引擎:MCP + LLM + Agent 架构赋能!
本文介绍MCP(Model Context Protocol)模型上下文协议,它是Anthropic于2024年11月底推出的开放标准,可统一大模型与外部数据源和工具通信协议,打破数据孤岛,有诸多优势,还适用于多个场景。
南洋理工、北大、上海AI实验室开源长记忆世界模型
目前世界模型模拟方法在维持长期一致性上有挑战,南洋理工大学、北京大学王选计算机技术研究所、上海人工智能实验室联合开源长记忆世界模型WORLDMEM,介绍了其记忆机制、基础架构、训练技术及检索策略等。
近500页史上最全扩散模型修炼宝典,宋飏等人一书覆盖三大主流视角
宋飏等人所著《The Principles of Diffusion Models》共460多页,系统梳理扩散模型发展脉络与核心思想,以统一数学框架串联多种视角,是研究者参考资料与初学者入门读物。
智谱GLM-5.1深度评测:8小时连续工作,开源大模型进入"工程交付"新纪元
2026年4月8日智谱发布GLM-5.1,它是全球首个通过真实工程任务验证8小时持续工作能力的开源模型,在SWE-Bench Pro上超越GPT-5.4等登顶。该模型性价比高、技术创新多,还适配国产硬件,开源生态友好。