「C端应用」共找到 2650 篇相关文章
小鹏加速冲向L4终局:对VLA架构「动刀」成关键一环
在辅助驾驶领域,端到端的VLA方法虽有效果,但面临中间层语言难以准确表达物理世界细节的问题。小鹏汽车去掉“语言转译”环节,推出第二代VLA,有跨代级驾驶体验,背后是底层技术架构重构。
2K Star!颠覆PPT!这个560KB的HTML文件,把整个办公套件装进了一个文件里!
Bento是开源项目,把文档、编辑器等全打包进约560KB HTML文件,功能堪比PowerPoint。它数据纯JSON、支持AI协作与端到端加密协作,还自研多个引擎,有多种上手和与AI协作方式。
在云栖大会,一场关于AI Agent的变化正在发生|甲子光年
企业应用AI正从“调用模型”转向“构建AI Agent”。云栖大会展示了其在多行业的应用,如教育、工业、零售等。不过,企业落地AI Agent面临技术、场景、合规和商业回报等挑战,阿里云提供了构建方案。
首个语音智能体端到端测评出炉:Grok登顶,真实场景通过率仅一半
Artificial Analysis推出业内首个语音转语音智能体端到端性能基准τ - Voice,测试真实客服场景能力。结果显示最强S2S模型成功率刚过一半,Grok Voice Think Fast 1.0夺冠,但也面临诸多质疑。
天下苦VAE久矣:阿里高德提出像素空间生成模型训练范式, 彻底告别VAE依赖
当前主流图像生成技术训练范式依赖VAE,带来训练复杂、微调成本高的问题。阿里高德提出EPG,结合自监督预训练与端到端微调,去除对VAE依赖,在训练效率和生成效果上有突破。
从 VLM 到 VLA,智驾距离跨过「L2.9999」还有多远?
2025 年上半年,国内智驾安全受关注,浮夸宣传行不通。文章探讨厂商智驾宣传卡「L2.9999」玄机、端到端成主流原因等,分析了 L2 与 L3 区别及事故责任界定,还提及车企应对策略。
Gemini盘活了谷歌全家桶,“原生”自带你10年的记忆
谷歌发布由Gemini3驱动的“Personal Intelligence”功能,底层连接旗下四大应用,让AI跨应用获取数据,还内置纠错机制。该功能现处Beta测试,未来覆盖免费用户。谷歌与苹果引入Gemini后路径不同,AI竞争也转向生态构建。
【CIKM'2026】CQ-SID:LLM生成式检索在手猫搜索召回中的探索与应用
文章围绕LLM生成式检索在手猫搜索召回的应用展开。先点明当前搜索召回机制问题及生成式检索挑战,提出CQ - SID等方法,经实验验证其效果佳,还介绍了线上实验成果,最后展望未来探索方向。
性能提升84%-166%!L-Zero仅靠强化学习解锁大模型探索世界的能力 | 已开源
招商局狮子山人工智能实验室团队用RLVR让模型“自学”,构建L0系统,含NB - Agent框架和端到端强化学习训练流程,开源相关内容。测试显示L0显著提升模型性能,展现强大泛化能力。
顶级邪修再战 Nano Banana Pro ,超多玩法,太猛了这玩意!
谷歌发布 Nano Banana Pro 模型,将图片模型能力推向顶峰,支持中文。它能生成准确视觉内容、多语言文本,可混合多元素,支持多分辨率。经测试,其各方面表现出色,应用场景丰富,版权限制宽松,三方应用和谷歌官方均可使用。