「技术难题」共找到 3801 篇相关文章
奥特曼下注27岁神秘青年,「复活」世界最顶级实验室
27岁的路易斯·安德烈获奥特曼、孙正义等投资,成立Episteme公司,欲打造现代版贝尔实验室。该公司旨在支持科研者,让其摆脱压力专注研究,虽面临诸多挑战,但也有成功可能。
全球68%科研人压力爆表,高校AI人才集体大逃亡!
高校AI科研「内卷」加剧,经费缩水、压力增大。爱思唯尔数据显示68%科研人发论文压力暴增,面临时间与资源双重困境。杜克大学陈怡然教授分享看法,工业界崛起,高校面临转型。
EMNLP 2025 Oral|检索增强 + 两阶段微调:剑桥提出有害内容检测大模型RA-HMD,性能SOTA
多模态有害信息检测是网络内容安全治理的重难点,多模态模型在有害内容检测上有瓶颈。剑桥大学团队提出RA - HMD框架,通过两阶段微调与结构增强,结合检索增强,提升检测性能,被EMNLP 2025接收。
长达790年视频镜头,打造原生多模态世界模型!北京智源研究院用Emu3.5统一“世界”
北京智源研究院发布并开源基于原生多模态训练的世界学习者Emu3.5,它将视觉和语言视为同一种数据流,在超13万亿token数据上学习,解决长视野多模态信息处理问题,经多阶段训练和优化,能力强大且已开源。
具身智能体不再失忆!智源新记忆系统让机器人秒变熟人,支持终身记忆
智源研究院等联合提出全新终身记忆系统RoboBrain-Memory,是全球首个为全双工、全模态模型设计的系统。它能解决具身智能体交互问题,实现类人长期个性化交互,在多方面表现优异,有广泛应用前景。
谷歌首次曝光太空AI计划:要建“AI版星链”,AGI的终极基础设施?
谷歌曝光Project Suncatcher计划,要构建太空AI计算集群。此设想是部署卫星星座建“太空数据中心”。虽面临诸多挑战,但从物理学和经济可行性看并非遥不可及,谷歌已发表相关预印本论文。
抖音SAIL团队联合港中文MMLab推出SAIL-Embedding:打通「视、文、音」的全模态嵌入
字节跳动抖音SAIL团队联合港中文MMLab提出SAIL - Embedding,专为大规模推荐场景设计,实现视、文、音统一表征,解决传统多模态模型局限,在抖音业务场景效果显著,相关技术报告已公开。
大涨240%,Doc-Researcher确立多模态文档深度研究新范式
在ChatGPT引领的AI革命中,大语言模型面对专业复杂文档常“束手无策”。Doc-Researcher提出三位一体解决方案,构建M4DocBench评测,性能远超现有方案,还适用于多产业场景。
LLM的下一战:从狂卷数据到精算数据
大模型竞争核心正从比拼数据规模转向数据使用效率和风险管理。文章分享2025两篇论文,介绍高效训练和机器遗忘两赛道,前者有数据价值飞轮5大模块,后者提出三时段分类法、三层次遗忘及评价指标全景。
从 CIPS & CLM 迈进:中国大模型的智能跃迁
中国中文信息学会2025学术年会暨第二届中国大模型大会(CIPS & CLM 2025)于10月28日在北京召开,众多专家学者参会。大会聚焦大模型多方面内容,发布“大模型基金”,举办多场报告与论坛,展现中国AI领域进展。