独立探索」共找到 905 篇相关文章

产品应用8

2.4万亿参数原生全模态,文心5.0一手实测来了

文心5.0正式发布,主打原生全模态,支持全模态输入和输出。官方测试显示其多维度表现突出,在LMArena文本排行榜并列全球第二。实测其理解精细、能捕捉细节,技术上采用自回归统一结构和超大规模混合专家架构。

量子位
推荐文章7

强化学习 AI 系统的设计实现及未来发展

本文是阿里巴巴算法专家曹宇在 AICon 2025 北京站的分享,结合算法实践展示 RL 系统现状及发展脉络,探讨未来超大规模 RL 发展方向,涉及理论基础、业界实践、开源生态及社区共建。

AI前线
新闻资讯7

战火升级!奥特曼正式杀入脑机接口,这次不用切脑

近日,奥特曼邀专家加入脑机接口创业公司Merge Labs,计划以8.5亿美元估值融资。它将采用非侵入式技术,与马斯克Neuralink的开颅手术竞争,奥特曼曾投资Neuralink但不认同其侵入式做法。

新智元
新闻资讯8

Mamba-3惊现AI顶会ICLR 2026!CMU知名华人教授一作首代工作AI圈爆红

Transformer有力挑战者Mamba的最新版本Mamba-3进入ICLR 2026盲审。它有三大改进,在长文本处理、实时推理和成本优化有优势。此外,FBAM也从不同角度探索Transformer下一代框架。

新智元
算法论文8

为MoE解绑:全新「专家即服务」推理架构发布,超细粒度扩展锐减37.5%成本

近年来大模型推理开销增长,MoE架构虽能避免计算量同比增,但带来扩展性差、容错性低、负载不均等问题。为此作者提出全新「专家即服务」推理架构EaaS,实验显示它能锐减37.5%成本。

机器之心
开源动态7

超越ZIP的无损压缩来了!华盛顿大学让大模型成为无损文本压缩器

华盛顿大学SyFI实验室提出LLMc,利用大型语言模型进行无损文本压缩。基准测试显示其压缩率优于传统工具,且项目已开源。不过,当前版本存在效率、吞吐量等问题,应用范围也主要在自然语言。

量子位
产品应用7

独家丨专访 Tunee 产品负责人:国内首个对话式音乐创作 Agent,刚上线就好评如潮!

文章是对 Tunee 产品负责人的专访。Tunee 是国内首个对话式音乐创作 Agent,能记住用户偏好,自动完成母带与混音。团队坚持‘人人都能玩点音乐’,将在云栖大会发布新模型与吉他,还探讨了产品问题与未来规划。

特工宇宙
新闻资讯8

不等风来,要做风的源头:海淀孵化器新政以“场域孵化”催生创新范式跃迁 | 甲子光年

在全球经济与科技变革背景下,孵化器正经历范式重塑。海淀出台《海淀区高质量孵化器政策》,构建“创新策源场”,通过“源头激活”“垂直深耕”“生态协同”引领行业升级,助力创新发展。

甲子光年
算法论文8

EMNLP2025 | 揭开LLM训练数据中的中文污染真相,有比“您好”高2.6倍的token?

近年来,大型语言模型虽成功,但训练数据易混入不良内容。论文《Speculating LLMs' Chinese Training Data Pollution from Their Tokens》探索此问题,定义PoC Token,开发PoCDetect和PoCTrace工具,揭示LLMs训练数据污染情况。

深度学习自然语言处理
推荐文章7

2025.7.4上午 | 视觉智能驱动的多模态对齐与推理的近期系列工作分享 - 复旦博士生王思尹

本次分享由复旦博士生王思尹围绕‘视觉智能驱动的多模态对齐与推理’展开,介绍多模态大模型探索研究,涉及跨模态组合语义理解、视觉参与推理及基于视觉建模世界完成行动等内容。

深度学习自然语言处理