哥大团队」共找到 7267 篇相关文章

产品应用8

中国电信天翼AI发布首款AI眼镜,星辰模型开启第一视角智能交互新时代

在2025世界人工智能会上,中国电信天翼AI发布全球首款融合自研“星辰模型”的智能穿戴设备——天翼AI智能眼镜,依托云网融合与星辰模型,开创第一视角智能交互新范式。

AI科技评论
产品应用8

三星研究院发布手机端侧模型MeKi:基于Memory的LLM扩展新范式,支持旗舰手机端侧部署

三星研究院发布端侧模型架构MeKi,提出用存储空间扩展模型容量、提升LLM性能的新范式。它利用手机ROM缓解内存压力,实现容量与性能提升。实验显示其性能、效率表现优,为边缘部署LLM提供新思路。

AI科技评论
新闻资讯7

Nano Banana核心团队:图像生成质量几乎到顶了,下一步是让模型读懂用户的intention

这是对Nano Banana核心团队的专访。团队认为图像生成质量提升空间有限,未来关键在模型可表达性和读懂用户意图。还探讨了图像模型发展趋势、应用场景、产品设计、评估方式等,提及与传统工具将长期共存。

Founder Park
算法论文8

复旦、同济和港中文等重磅发布:强化学习在语言模型全周期的全面综述

来自多所顶尖科研机构的研究者完成长文综述,总结语言模型全生命周期的强化学习研究,阐述其各阶段应用策略,分析未来挑战与趋势,重点关注 RLVR 技术,有全生命周期梳理等三贡献。

机器之心
算法论文8

联手通义实验室发布ZeroSearch:成本暴降88%,无需搜索即可激活语言模型的检索能力!

与通义实验室发布ZeroSearch框架,可无需真实搜索激活语言模型检索能力。它引入语言模型模拟搜索、采用结构化模板等策略,成本降88%,多项实验显示其性能超越基线与真实搜索方法。

深度学习自然语言处理
算法论文8

模型推理也能“智能调度”:让奖励模型按需分配算力的动态路由机制 | ACL 2026

生成式奖励模型(GRM)推理策略存在算力浪费问题。腾讯混元与新南威尔士学联合提出 E - GRM 框架,将模型不确定性定义为调度信号,按需推理。文章从多维度解读该框架,并展示实验评估结果。

InfoQ
算法论文8

ACL'25最佳论文解读 | 模型也会‘弹簧回弹’?揭秘 LLM 对齐的脆弱根源

本文分享 ACL 2025 最佳论文,指出预训练模型存在‘抗对齐’的 Elasticity 现象,即对齐微调只是暂时拉伸,后续微调会让其迅速弹回预训练分布。研究量化该概念,用‘压缩理论’刻画对齐并实验验证。

PaperAgent
产品应用8

揭秘夸克首个高考志愿模型!蒸馏数百名人类专家经验、Agent 可完整生成志愿报告

6月12日,夸克发布国内首个高考志愿模型,上线‘高考深度搜索’等三核心功能。其‘志愿报告’以Agent运行,能输出完整报告;模型经多阶段训练,搭载最高考知识库,为考生提供精准志愿填报服务。

AI科技大本营
开源动态8

Day0迁移、一键部署,华为开源的昇思MindSpore成为模型开发的“万能钥匙”

模型无法一统天下的背景下,开发者面临在一个框架、生态体验众多主流模型和AI技术的难题。华为开源的昇思MindSpore可实现训练Day0迁移、推理一键部署,还介绍了其相关技术和实测效果。

量子位
算法论文8

网络顶会获奖!华为提出端网协同RDMA传输架构,解决规模AI集群网络可扩展性问题

全球网络通信顶会 ACM SIGCOMM 2025 落幕,华为与港科合作的 DCP 研究成果获奖。该论文提出数控分离传输架构 DCP,解决规模 AI 集群网络可扩展性难题,实验显示其性能优于现有 RDMA 方案。

机器之心