移动端体验」共找到 1225 篇相关文章

算法论文8

KDD 2025 | UoMo来了,首个无线网络流量预测模型,一个框架搞定三类任务

在 ACM KDD 2025 大会上,清华与中国移动联合发布 UoMo,全球首个面向移动网络的通用流量预测模型。它结合扩散模型与 Transformer,能理解地理与人流变化,一个框架搞定三类流量预测任务。

机器之心
开源动态7

NextStep-1:一次在图像生成上自回归范式的探索

阶跃星辰团队探索自回归图像生成新路径,推出 NextStep-1。它直接在连续视觉空间自回归生成,架构简洁,实现训练。模型有高保真生成和编辑能力,Benchmark 表现佳,但也面临稳定性等挑战。

机器之心
新闻资讯7

「神经软件」正在到来,人类代码将失去意义!

Lambda Labs CEO Stephen Balaban 在英伟达 GTC 2025 提出神经软件概念,指不再写代码,让大语言模型成软件。它没传统软件的 bug 问题,未来计算机或神经化,虽有争议,但变革在加速。

AGI Hunt
新闻资讯8

豆包19亿次互动背后的技术真相:春晚级体验是如何炼成的?

2026 年春晚 AI 元素亮眼,豆包 AI 互动达 19 亿次。火山引擎作为独家 AI 云合作伙伴,用智能视频云等技术打造节目效果,解决视频画质、空间逻辑、机器人互动延迟等难题,还保障全民互动和实时字幕。

InfoQ
产品应用8

音乐新王震撼降临,Al音乐进入格莱美时刻

2026开年,MiniMax Music 2.5发布,凭「格莱美级」音质、极致拟真人声开创AI音乐新高度。它消除中文演唱「洋味儿」,支持14种结构标签精准控制,让音乐制作门槛降低,从C娱乐迈向B生产力。

新智元
Product Application7

PDF难点解析:处理复杂表格、水印、印章、复选框、信息抽取等7项任务,6大能力

文章介绍Nanonets - OCR - s可处理关键信息提取、视觉问答等7项任务,具备LaTeX方程识别、图像描述等6项能力,还给出体验链接。但测试发现英文体验优于中文,模型有重复输出、幻觉严重问题。

CourseAI
开源动态8

2K Star!颠覆PPT!这个560KB的HTML文件,把整个办公套件装进了一个文件里!

Bento是开源项目,把文档、编辑器等全打包进约560KB HTML文件,功能堪比PowerPoint。它数据纯JSON、支持AI协作与加密协作,还自研多个引擎,有多种上手和与AI协作方式。

开源星探
新闻资讯7

首个语音智能体测评出炉:Grok登顶,真实场景通过率仅一半

Artificial Analysis推出业内首个语音转语音智能体性能基准τ - Voice,测试真实客服场景能力。结果显示最强S2S模型成功率刚过一半,Grok Voice Think Fast 1.0夺冠,但也面临诸多质疑。

AI工程化
推荐文章7

我的AI年度盘点

博主黄益贺做年度AI使用盘点。系统层面,从外挂式RAG旧体系转向以Coding Assistant为核心新体系,结合MCP、Skills等完善系统;工具层面,全面拥抱Google生态,C看好Google,B看好Anthropic,不看好OpenAI。

newtype AI
算法论文8

天下苦VAE久矣:阿里高德提出像素空间生成模型训练范式, 彻底告别VAE依赖

当前主流图像生成技术训练范式依赖VAE,带来训练复杂、微调成本高的问题。阿里高德提出EPG,结合自监督预训练与微调,去除对VAE依赖,在训练效率和生成效果上有突破。

量子位