多语言同传」共找到 4902 篇相关文章

开源动态8

AI秒懂短视频,快手大模型Keye-VL理解力爆表!技术细节全开源

快手全新模态大语言模型Kwai Keye-VL上线且开源,能深度融合模态信息,在视频理解、复杂视觉感知和逻辑推理上表现优异。介绍了其技术架构、预训练和后训练策略及训练架构优化等内容。

新智元
算法论文8

NeurIPS 2025 Spotlight | 让检索、推理真正「合体」的小而强模型,AceSearcher来了

近期,所高校研究团队发布 AceSearcher 模型,它是让语言模型在推理时兼任双角色的合作式自博弈框架,以两阶段训练为骨架,将推理与检索结合,提升复杂检索任务效果,在任务上表现出色。

机器之心
算法论文8

用「传心术」替代「对话」,清华大学联合无问芯穹、港中文等机构提出Cache-to-Cache模型通信新范式

随着大语言模型发展,智能体系统中现有T2T交流方式有信息丢失、语义模糊、延迟大问题。清华等团队提出C2C信息传递方式,以KV - Cache为媒介,提升了正确率和速度,还介绍了实现路径、优势及应用前景。

机器之心
算法论文8

充分激发模态协作,MokA量身打造MLLM微调新范式

当下模态大模型微调「照搬」单模态微调策略,忽视模态差异。中国人民大学和上海人工智能实验室团队提出 MokA 方法,兼顾单模态与跨模态建模,在基座、场景实验中显著提升性能。

机器之心
开源动态8

7.3K Star!用 Orca 组建 AI 舰队:让 Claude Code 和 Codex 时开工!

Claude Code 大火后,家大厂推出自家 Code CLI,终端操作上下文切换成本高。Orca 是开源 AI 编排器,可让个 AI 编程助手并行工作,集中查看结果,有并行工作区、统一管理界面等亮点。

开源星探
算法论文8

腾讯提出Vision-SR1:让模型真正学会“看图思考”,而不是“蒙答案”

视觉语言模型(VLMs)存在视觉幻觉和语言捷径问题,限制其可靠性和泛化能力。腾讯提出Vision - SR1训练方法,通过推理分解和自我奖励机制,不依赖外部监督,提升模型视觉感知和推理可靠性。

深度学习自然语言处理
新闻资讯8

现场围观腾讯广告算法大赛,我都想入职了

腾讯广告算法大赛冠军可得200万奖金,赛题是「全模态生成式推荐」,涉及AI方法,贴近真实业务且挑战。比赛持续四月,氛围友好。腾讯借此揽才,也为学生提供进大厂通道。

量子位
新闻资讯8

哇塞,今天北京被机器人人人人人塞满了!

世界机器人大会在北京开幕,100个新机器人亮相。智平方的爱宝机器人人气爆棚,它能用一个基座模型完成任务。其搭载的GOVLA大模型有四大核心能力,且已在行业商业化落地。

量子位
开源动态8

全能高手&科学明星,上海AI实验室开源发布『书生』科学模态大模型Intern-S1 | WAIC 2025

7月26日,上海AI实验室在WAIC 2025上发布并开源科学模态大模型Intern-S1。它融合学科知识,首创跨模态科学解析引擎,在学科任务上超越顶尖闭源模型,还支撑构建了智能体系统。

机器之心
新闻资讯8

提效软件研发,AI Agent好用吗?

InfoQ直播邀请位专家探讨AI4SE,提及前端知识库特点、Agent自学习等。专家认为AI目前辅助人类,落地要重视“人”因素,还探讨了应用挑战、衡量维度、未来趋势等,QCon上海站将设专题。

InfoQ