「哥大团队」共找到 7284 篇相关文章
懂方言,通诗词,精通30国语言,阿里发布语音识别大模型Fun-ASR1.5
阿里发布语音识别大模型Fun - ASR1.5,可精准识别30种语言,覆盖中文七大方言体系及二十余种地方口音,强化古诗词诵读专项识别,后处理环节优化标点预测和文本归一化,降低人工成本。
从「时域建模」到「频域融合」:中山大学团队为传感器人体活动识别提供新思路 | TPAMI 2026
中山大学团队在IEEE TPAMI发表研究,用“三重频域融合”(TSF)框架突破传感器人体活动识别(HAR)领域核心瓶颈。该框架从三个全新“视角”审视问题,经多数据集评估表现出色。
马斯克xAI正式入局世界模型,目标:明年搞出个AI生成的大游戏
马斯克的xAI入局世界模型开发,对手是Meta和谷歌等。其从英伟达挖专家,目标是开发先进AI系统,还计划明年底前发布AI生成游戏。不过构建世界模型挑战大,游戏行业有人对此谨慎。
Agent、图像、视频全是大版本升级:春晚还没开,豆包AI就火了
2026年AI市场竞争激烈,海外公司密集发布新模型致华尔街震动。国内腾讯、阿里、字节参战,字节官宣豆包参与春晚互动。2月14日火山引擎宣布豆包系列模型全面升级,含大模型2.0、图像模型Seedream 5.0 Lite、视频模型Seedance 2.0。
老黄自曝皮衣口袋藏“秘密期权池”!随时准备奖励员工,团队亿万富翁数量世界第一
黄仁勋在采访中透露随身带“秘密期权池”奖励员工,称团队亿万富翁数量世界第一。他还谈及人才市场、芯片分配、AI对就业和经济影响等,如认为收购公司不如付一人10亿,芯片分配先到先得等。
大模型“精细化”对齐,真实性提升25.8%刷新SOTA!token级精准编辑,无需训练即插即用
北航团队在EMNLP 2025提出Token - Aware Editing (TAE)方法,从token层面解决传统表征编辑技术问题,无需训练、即插即用,在多个对齐维度显著提升,如在TruthfulQA任务上真实性指标提升25.8%。
每2秒吃透一道高数大题!华为终于揭秘准万亿MoE昇腾训练系统全流程
华为揭秘准万亿MoE昇腾训练系统全流程,通过“昇腾+Pangu Ultra MoE”实现国产算力与模型自主可控训练闭环,从集群利用率、单节点算力、后训练技术三方面突破,实现大模型高效训练。
“具身智能始祖公司”破产后卷土重来,这次团队做了一个会撒娇的毛茸机器人
具身智能始祖公司创始人科林·安格尔在公司破产重整后推出新公司 Familiar Machines & Magic,首款产品 Familiar 是仿生宠物机器人,有情感智能,能本地处理信息,团队希望它用于监护老人等场景。
大模型是「躲在洞穴里」观察世界? 强化学习大佬「吹哨」提醒LLM致命缺点
加州大学伯克利分校副教授、强化学习大牛Sergey Levine在博客指出,当前大语言模型(LLM)只是对人类大脑和思维的间接「扫描」,如同被困洞穴看人类智慧「投影」,无法代替真正思维。
Speech LLM 的下一个突破口:你的语音大模型可以是个「带韵律的文本模型」
语音大模型存在‘模态代沟’致性能‘降智’,此前两波改进未根本解决。香港中文大学论文提出TextPro - SLM架构,从输入端破局,仅用约1000小时数据就实现低‘模态代沟’,对多模态模型设计有启发。