长安的荔枝」共找到 987 篇相关文章

产品应用7

突破视频时限制!Manus上架视频生成功能,网友:比Sora更好

Manus上架视频生成功能,可通过连续拼接突破时限制。它按“拍电影”方式,根据提示词生成片段再合成故事。网友评价是新创作方式,但效果有提升空间,部分人认为比Sora好。

量子位
产品应用8

国产手机正从底层重构卓!vivo版AI OS亮相了

在vivo开发者大会上,OriginOS 6正式亮相,AI功能全面更新,还首次上线Live Photo的AI消除。它用自研技术重构卓底层核心,首发蓝河流畅引擎,从计算、显示、存储三大模块优化。

量子位
算法论文8

内存直降50%,token需求少56%!用视觉方式处理文本

在NeurIPS 2025论文中,南京理工大学等校研究团队提出VIST框架,为大语言模型文本高效推理提供视觉解决方案。它模仿人类阅读机制,让模型具备选择性阅读能力,减少Token需求和内存使用。

新智元
新闻资讯8

从海外断供到全国产闭环,世中国做对了什么?

世中国在2025年9月30日遭海外断供晶圆后,于次年8月23日新品全球发布会公开亮相。其从组织、供应链、研发、渠道四方面重构,取得12英寸量产等成果,还给出未来路线图,有重大产业意义。

芯师爷
产品应用8

谋科技Arm China“玲珑”VPU IP来了!瞄准这些应用场景

谋科技Arm China推出面向AI应用的新一代VPU IP——“玲珑”V560/V760。该产品性能硬核,是“六边形战士”,集高性能、高鲁棒性等六大特性于一身,已完成首批客户授权,助力AI时代视频处理。

芯师爷
产品应用7

求稳的全IP,谋科技如何守正出奇?|甲子光年

12月24日,谋科技推出新一代SPU IP——“山海” S30FP/S30P,构建覆盖芯片底层至应用层的一栈式全防护体系,有抗物理攻击强等五大亮点,能适配不同场景全需求,完善产品布局。

甲子光年
算法论文8

多模态后训练反常识:思维链SFT和RL的协同困境

华为与香港科大研究发现,多模态视觉语言模型中,思维链SFT与RL组合难协同增益。研究引入难度分类方法构建数据集,分析各方法表现及组合策略困境,还给出实验发现与未来研究方向。

机器之心
开源动态8

面向时语音与声音克隆的全模态开源万能聊天机器人MGM-Omni

文章介绍了全模态开源聊天机器人MGM - Omni,它基于MiniGemini,支持多模态输入输出,具备语音理解、生成、流式生成、零样本语音克隆等特性,还给出装、使用方法,展示评估结果。

GitHubStore
算法论文8

与DeepSeek-OCR不谋而合,NeurIPS论文提出让LLM像人一样读文本

NeurIPS 2025 论文提出 VIST 框架,为大语言模型文本推理提供视觉方案,与 DeepSeek - OCR 理念不谋而合。它模仿人类阅读,有快 - 慢路径协作,在多任务表现优,还让模型‘用眼看文字’,优势明显。

机器之心
算法论文8

小红书RecSys 2025最佳论文提名背后:破解视频时预测难题

小红书推荐算法团队论文《Multi-Granularity Distribution Modeling for Video Watch Time Prediction via Exponential-Gaussian Mixture Network》在 RecSys 2025 获最佳论文提名。该文剖析视频时预测难题,提出 EGMN 模型,线下线上验证效果佳。

机器之心