大模型V4」共找到 9300 篇相关文章

算法论文8

Stream-Omni:同时支持各种模态组合交互的文本-视觉-语音多模态模型

中国科学院计算技术研究所团队提出文本-视觉-语音多模态模型Stream-Omni,能支持多种模态组合交互。它对各模态关系针对性建模,实现高效灵活的模态对齐,仅用少量语音数据就有多种交互能力。

机器之心
产品应用8

全球最强AI音乐模型,现在来自中国!高晓松也来围观了

昆仑天工发布音乐模型Mureka V8,实测打败硅谷Suno V5成世界第一。它能生成完整可发布歌曲,结合MusiCoT技术实现从“能生成”到“能发布”跨越。高晓松等认可其变革潜力,昆仑天工联合太合音乐打通产业链。

量子位
新闻资讯8

范式跃迁:LLM + EC重构算法设计范式,华为&港城夺冠CVRP国际顶级赛事

近日,华为与港城联合团队‘OptVerse - CityU’在CVRPLib BKS全球挑战赛夺冠。他们用‘模型(LLM)+进化计算(EC)’架构,刷新98个历史最优解,51个设新纪录,验证AI在算法设计潜能。

机器之心
产品应用8

Deepseek V4 Pro发布,除了多模态,满足我对模型的所有想象

DeepSeek官方文档更新模型日期,意味着DeepSeek V4 Pro正式版来临,已在官方API提供。它采用MoE设计,接口能力强,Agent能力得到幅强化,评测成绩亮眼,价格实惠且有API兼容性,不过有并发限制,近期还将上调价格。

鲸选AI
新闻资讯8

VAST完成5000万美元A轮融资,加速构建世界模型与UGC互动内容平台

通用人工智能公司 VAST 完成 5000 万美元 A 轮融资,由阿里、恒旭资本联合领投。该公司在 3D 领域成果显著,发布全新 AI 3D 模型家族,还将重点投入世界模型研发和 UGC 互动内容平台建设。

机器之心
产品应用7

拍我AI V5模型发布,AI视频的“不可能三角”被解开了?

拍我AI推出V5模型,一上架就到Artificial Analysis榜单前列。它在多维度升级,维持速度和性价比优势,试图解开AI视频生成“不可能三角”。文章实测其运动、二次元、商业等场景表现,还提及速度与价格优势。

花叔
算法论文8

治好多模态近视和走神!上海学去偏干预显著提升模型性能

多模态模型存在“近视”和“走神”问题,总是过度关注图像底部而忽略核心内容。上海学与南开学研究团队用两条数学公式去偏干预,无需增加计算成本,却能显著提升主流模型视觉理解能力。

AIGC开放社区
新闻资讯8

新天终启,万象智生!从AlphaGo到GPT-5,新智元十年见证ASI创世纪

2025年AI迈向ASI,新智元迎十周年,9月7日将在北京举办峰会。众多咖齐聚,探讨芯片、模型等前沿突破。今年模型发布密集,如OpenAI、谷歌等有新成果,中国造模型也表现出色,未来智能体等将爆发。

新智元
算法论文8

dLLM的「Free Lunch」!浙&蚂蚁利用中间结果显著提升扩散语言模型

近年来,扩散语言模型(dLLM)成为文本生成新势力,生成效率高。但现有解码策略忽视中间迭代信息,研究团队观察到「先对后错」现象,提出 TCV 和 TCR 方法,显著提升模型在推理任务表现。

机器之心
产品应用8

后OpenClaw时代!国产Agent模型凭「高配低价」叫板Opus 4.6

昆仑万维旗下天工AI发布SkyClaw - v1.0智能体模型及轻量化版SkyClaw - v1.0 - lite。该模型在底层能力提升,适配主流框架,跑分和实际应用表现出色,还具有低门槛、高性价比优势,限时免费体验。

机器之心