赋能增值」共找到 5045 篇相关文章

推荐文章7

中学生就看懂:从零开始理解LLM内部原理【十二】|位置嵌入 - 给模型装上"GPS"

文章指出Transformer对词顺序不敏感,引出位置嵌入概念。介绍经典的函数编码、可学习位置嵌入法及新主流RoPE,还提及为让模型处理长文本,在RoPE基础上用PI和YaRN等扩窗技巧。

AI大模型应用实践
开源动态8

群核科技开源两款空间大模型,想解决 Genie3 没彻底解决的问题

2025年8月25日群核科技举办TechDay,发布专注3D室内场景的空间大模型,开源SpatialLM 1.5和SpatialGen。两款模型分别解决理解交互和空间一致性问题,有实际应用价值,还介绍了数据飞轮效应及模型相关问答。

Founder Park
新闻资讯8

OpenAI深夜祭出GPT-5,所有人免费用!Altman:像和博士级专家对话

北京时间8月8日凌晨,OpenAI推出GPT - 5,宣称其更智、准确,幻觉率低。还推GPT - 5 - mini和GPT - 5 - nano两款新模型,免费用户可使用部分版本。它在编程和健康领域测试表现出色,引发各界热议。

InfoQ
新闻资讯7

最新内幕!GPT-5没取得技术突破,OpenAI核心投奔小扎另有隐情

据内幕消息,OpenAI面临数据瓶颈和技术难题,GPT - 4.5未达预期,GPT - 5转向实用改进。同时,公司存在技术转化问题、内部关系紧张等挑战,还在与微软谈判,也在为IPO做准备。

AI寒武纪
产品应用7

实测Gemini图片转视频新功,终于蹲到经典梗图后续了(doge)

Gemini接入带声音的图片转视频功,作者实测该功。用开盒指令测试,生成速度较快;还尝试给梗图加后续,发现生成精确内容需详细提示词,且不生成具体真人形象内容。

量子位
开源动态8

谷歌开源Gemma 3n:2G内存就跑,100亿参数内最强多模态模型

本周五凌晨,谷歌正式发布、开源全新端侧多模态大模型 Gemma 3n。它有多模态设计、专为设备端优化等特性,核心是 MatFormer 架构,还采用了 PLE 技术等,在多方面实现质量提升。

机器之心
产品应用8

这个AI救命!提前6个月发现胃癌病灶,突破医学影像认知,达摩院做成了

国内成果登《自然·医学》,全球首个用平扫CT识别早期胃癌的AI模型DAMO GRAPE诞生。它突破传统影像限制,提升胃癌检出率。此前达摩院还研发出筛查胰腺癌的DAMO PANDA,未来探索‘一扫多查’。

量子位
算法论文8

单卡4090也高质量视频编辑!西湖AGI Lab无训练框架FlowDirector来了

视频编辑门槛高、现有方法开销大且效果不佳。西湖大学AGI Lab团队提出无需训练的FlowDirector框架,可将基于流的视频生成模型改造成编辑工具,质量高、功广、开销低,解决了时序、结构和编辑幅度问题。

机器之心
新闻资讯8

苹果放王炸!开放大模型访问权、全家桶集成ChatGPT,人人开发AI应用

苹果在“WWDC 2025”大会宣布在多设备集成Apple Intelligence功,含ChatGPT图像生成等。开放基础模型访问权,开发者可开发适配应用。新功将逐步开启测试,今年秋季部分用户可用。

AIGC开放社区
推荐文章7

中学生就看懂:从零开始理解LLM内部原理【九】| 层归一化:神经网络的稳定器

本文是系列文章第九篇,介绍了神经网络中的层归一化。先回顾标准差、标准分概念,指出其可使差异可控稳定。接着说明层归一化将原思想用在神经网络,还加入可学习参数,最后总结其作用与应用位置。

AI大模型应用实践