全模态技术」共找到 4368 篇相关文章

新闻资讯7

0粉丝狂卷数十亿播放,靠AI流量欺诈获利近亿!网友:这“刑”得离谱

2024年球录制音乐市场总收入飙升,流媒体经济贡献突出,但AI技术引发的流媒体欺诈问题严峻。如北卡罗来纳州男子Michael Smith利用AI创作虚假歌曲欺诈获利,类似事件增多,平台反击成效不佳。

AI前线
算法论文8

音频大模型安可信度的面“体检”!6大维度,清华南洋理工联手打造

南洋理工和清华团队提出新框架AudioTrust,将ALLMs评估扩至六个核心维度,探究音频模态特有问题。目前基准及平台已开发,揭示了开源与闭源ALLMs在多维度的潜在风险。

量子位
产品应用7

这样更公平:用jina-reranker-m0为多模态文档打分重排

文章指出多模态搜索领域给文档综合评分难,因文本与图像评分缺乏可比性。2025年4月发布的jina - reranker - m0可解决此问题,其两阶段检索流程能显著提升召回率,对多模态AI系统设计有启发。

Jina AI
推荐文章7

详细介绍!RAG 和 GraphRAG:了解何时(When)、如何(How)使用它们

文章详细介绍传统RAG和GraphRAG技术,前者通过向量搜索检索上下文,但无法体现数据关系;后者用知识图谱提升检索效果,亮点是构建图谱、整合信息。还指出两者优缺点,建议结合使用。

AINLPer
开源动态8

红杉中国推出 Agent 基准测试「xbench」,双轨评估体系,关注 AI 真实场景的效用

红杉中国开放AI和Agent基准测试工具「xbench」,采用双轨评估体系,构建多维度测评数据集。首期发布两个核心评估集并排名,提出垂类Agent评测方法论。该工具旨在解决现有评估问题,关注AI真实场景效用。

Founder Park
新闻资讯7

印度国家级大模型上线两天仅 300 余次下载,投资人直呼“尴尬”:韩国大学生模型都有20万!

印度 Sarvam AI 发布国家级模型 Sarvam - M,虽被赞为本土 AI 突破,支持 10 种本地语言,但上线两天仅 334 次下载,投资人批其成绩尴尬,还与韩国大学生模型对比,引发社区争论。

AI前线
新闻资讯7

AI开源狂飙,OpenAI们慌了!GenAI大洗牌,2025趋势深度解读

2025年,ChatGPT仍领跑,但DeepSeek、Qwen等开源模型加速追赶。独立机构报告总结六大趋势,涵盖技术突破与市场格局演变,如推理模型实用化、MoE架构普及等,开源势力挑战闭源巨头。

新智元
新闻资讯7

AI接管程序员!Anthropic创始人自曝行业末日时间表

Anthropic创始人Dario Amodei预测,AI三到六个月内或能编写90%代码,一年后可能编写所有代码。谷歌超25%代码已由AI生成。不过人类短期内仍在代码设计等方面重要,程序员要适应与AI协作。

新智元
开源动态8

超低延迟的端到端语音模型!首次生成音频仅需53ms,比同级别模型快3-5倍!

随着语音应用场景普及,语音大模型响应慢成瓶颈。VITA团队开源端到端语音模型VITA - Audio,7B参数模型首次生成音频仅53毫秒,比同级别快3 - 5倍,完开源,有超低延迟等优势。

开源星探
新闻资讯7

6个月估值翻倍!黄仁勋力荐的AI搜索公司欲开发浏览器取代谷歌Chrome

AI搜索引擎公司Perplexity接近完成5亿美元融资,估值达140亿美元。其搜索引擎产品出圈,获黄仁勋力荐。该公司欲开发AI浏览器Comet取代Chrome,不过面临谷歌等多方竞争。

量子位