新注意力机制」共找到 4298 篇相关文章

产品应用8

刚刚,AI音乐被重定义!昆仑天工甩出王炸,拿下全球第一

如今AI神曲传播快,AI音乐或帮助作品出圈。1月28日昆仑天工发布音乐大模型Mureka V8,模型降低创作门槛,提出AI音乐成音乐品类概念。实测其作品出色,技术上靠MusiCoT和人声建模加持。

机器之心
新闻资讯7

独家|极佳视界再获一轮数十亿大额融资,估值超百亿,领跑世界模型赛道

AI科技评论独家获悉,极佳视界近日完成一轮数十亿大额融资,投资方阵容豪华。其成立于2023年,在世界模型技术与应用上领先,产品在多领域落地,还计划年内开启大规模Scaling进程。

AI科技评论
新闻资讯7

OpenAI模型Day0就被嫌弃!排名拉垮,不如一月底发布的国产模型

OpenAI推出GPT - 5.4 mini和nano模型,主打快速经济,针对编程等优化。但评测中GPT - 5.4 mini排名不佳,不如国产Kimi 2.5,且价格对比有争议。不过与自家旧版比有提升,网友测试有亮点。

量子位
产品应用7

Gemini CLI 升级:深度集成 VS Code,终于不用在终端和编辑器之间反复横跳了

Google发布Gemini CLI重要更,实现与VS Code深度集成,从架构层面解决AI编程助手的上下文感知问题。版本有工作区上下文感知和原生差异对比界面两个核心功能,还给出部署要求。

AI工程化
算法论文8

用两个简单模块实现分割理解双重SOTA!华科大白翔团队等推出多模态框架

华中科技大学和金山办公团队联合提出语义增强特征提取器(SEFE)和交错局部视觉耦合(ILVC)模块,构建多模态大模型LIRA,解决现有模型分割不精确和理解有幻觉问题,在分割和理解任务上达SOTA。

量子位
开源动态8

性能比肩DeepSeek-R1,MiniMax仅花380万训出推理大模型性价比王|开源

MiniMax开源推理大模型MiniMax - M1,原生支持100万token输入、8万输出,性能比肩DeepSeek - R1,仅花380万训成。采用Lightning Attention机制与CISPO算法,在多领域表现出色,模型权重可在HuggingFace下载。

量子位
开源动态8

阿里通义年礼物:开源最强Qwen-Image-2512版本告别AI塑料感与文字乱码

通义万相年前发布Qwen - Image - 2512版本。它是开源界最强文生图模型,在AI Arena盲测中表现出色。能消除AI塑料感,攻克文字渲染难题,在还原真实世界和重构视觉元素逻辑排版上有显著提升。

AIGC开放社区
推荐文章7

《中国Data&AI数据基础设施白皮书》——AI创生核心生产力,开启万亿基建之路 | 甲子光年智库

全球正处地缘政治与AI技术变革中,AI跃升为核心生产力。中国企业面临‘挤压式转型’,传统数据系统难满足需求。数据厂商需构建一代数据基础设施,技术上‘湖仓一体’与‘AI原生’融合,推动Data&AI一体化。

甲子光年
新闻资讯7

AI 时代的可观测性:不只看系统崩没崩,还要看模型有没有胡说

New Relic首席技术战略官Nic Benders与主持人探讨可观测性从传统到AI驱动的演进,提及LLM与统计方法协同处理海量数据,还讨论了监控AI系统的难题及可观测性核心是理解业务目标。

InfoQ
开源动态8

社区发布丨全面开源!商汤日日SenseNova U1发布,迈向模型理解生成统一时代

商汤科技正式发布并开源商汤日日SenseNova U1系列原生理解生成统一模型,基于NEO - unify架构,实现模态集成向原生统一跨越,其轻量版在多项测试达同量级开源SOTA,还能连续性图文创作。

Hugging Face