高质量专注」共找到 2402 篇相关文章

算法论文8

单GPU搞定清长视频生成,效率×10!引入Mamba机制突破DiT瓶颈 | 普林斯顿&Meta

普林斯顿大学和Meta联合推出新框架LinGen,以MATE线性复杂度块取代传统自注意力,使单张GPU能在分钟级生成质量视频。它在视频质量上优于DiT,减少FLOPs和延迟,与先进模型相当。

量子位
新闻资讯7

CEO让AI定裁员名单:被它反驳时,我选择怀疑自己!

Confluent报告显示,62%英国管用AI辅助决策,27%用其处理人事。88%称决策更快、83%表示压力更小,但65%认为决策不协作,70%与AI意见相左时会怀疑自己,数据质量也影响决策。

新智元
7

从 AI 招聘到数据标注,Mercor 能否打造下一个 Scale AI?

Mercor 从 AI 招聘平台转型为数据标注服务提供商,与 Scale AI 竞争。它利用早期人才招聘积累,为小规模、难度项目提供灵活方案,虽数据质量待提升,但增长快,2025 年初 ARR 达 7500 万美元,获 1 亿美元 B 轮融资。

海外独角兽
产品应用8

秘塔AI也终于悄悄上线了DeepResearch。

秘塔AI搜索上线新功能DeepResearch,作者测试后评价颇。它有可视化界面,能展示思考执行过程,打破AI黑盒。输出报告质量好、精准度,还可生成互动网页,且免费额度多,虽有小问题但仍值得肯定。

数字生命卡兹克
算法论文8

ICML26 | 浙江理工大学马啸讲师和南京大学李武军教授课题组联合提出EMCES:为强化学习合成更有价值的样本

强化学习获取质量样本成本、风险大,现有基于扩散模型的样本增强方法有局限。浙江理工大学马啸讲师和南京大学李武军教授课题组提出 EMCES,将情景记忆机制引入可控扩散模型,提升下游强化学习算法表现,论文已被 ICML2026 录用。

机器之心
产品应用7

季度AI视频生成产品:多模态输入成标配,角逐一站式生成能力 | 量子位智库AI 100

Sora2下载量破百万引发AI视频生成热潮,谷歌推出Veo3.1再掀潮。国外大厂将其卷至电影制作级创意,国内企业追求质量、秒级生成并落地垂直场景。量子位智库发布的产品呈现多维度技术演进。

量子位
产品应用8

vivo发布端侧多模态模型,只有3B可理解GUI界面,20项评测表现亮眼

vivo AI Lab发布端侧多模态模型BlueLM - 2.5 - 3B,融合文本与图文能力,支持长短思考模式切换。它在20余项评测中表现出色,参数量小,训练和推理成本低,有精巧结构、效策略,还有质量数据和性能平台支撑。

量子位
7

AI本该助力新人,为何反而让手更强?

人们曾认为AI能让初级程序员创造质量代码,减少对级工程师依赖。但现实是‘手 + AI’才是有效组合。文章分析AI优劣,指出其让手更强,还给出使用建议,强调要校准对AI的期待。

宝玉AI
算法论文8

给文档质量"打分":DIQA-5000 数据集与融合版面语义的 DocIQ 质量评估模型

文档图像质量评估(DIQA)是评判‘增强算法有没有把图变好’的关键工具。过去研究多围绕自然图像,缺文档专用数据集。本文提出DIQA - 5000数据集和DocIQ模型,补齐缺口。

机器学习AI算法工程
产品应用7

本地可运行的质量的文本转语音模型

介绍Kyutai的Pocket TTS,一款轻量级文本转语音应用,可在CPU效运行,模型小且低延迟,支持Python API和CLI,能语音克隆,还可在浏览器试用,目前仅支持英语,也有社区浏览器端实现。

GitHubStore