含模量」共找到 1089 篇相关文章

推荐文章7

深度长文解读 “世界型” :在虚构与真实交接之处凝视未来

本文深入解读“世界型”,虽无明确定义,但从目的出发分为表征和生成两类。前者生物大脑、视觉和语言中心预测;后者有基于规则拟和数据驱动生成。还探讨LLM是否为世界型,指出各类型相辅相成。

AI科技评论
开源动态8

美团重磅开源!13.6B通用视频生成大型,能文生视频、图生视频、还能续写!

AI视频生成竞争激烈,美团团队在GitHub开源通用视频生成型LongCat-Video,参数13.6B,能文生视频、图生视频、视频续写,几分钟生成720p、30fps长视频,有核心优势,还介绍了安装部署等内容。

开源星探
新闻资讯7

Codex 积分制计费上线,Claude Code 急了……

OpenAI Developers宣布Codex推出积分制度,重置速率限制,ChatGPT Plus和Pro用户可买积分获额外使用,每1000积分40美元。云端任务将计入速率限制,社区反应不一,且积分会过期,Claude Code为挽回用户送会员。

AGI Hunt
开源动态8

社区供稿 | Jina Embeddings V4: 为搜索而生,多态多语言向

Jina AI发布多态向型jina-embeddings-v4,参数38亿,能同步处理文本与图像。内置LoRA适配器强化检索等任务表现,在多基准测试中展现顶尖性能,支持单/多向表示。介绍了架构、上手指南等。

Hugging Face
新闻资讯7

阿里开启 Token 战略,喊出云+AI 年收入破千亿口号,底气从哪来?

3月19日晚,阿里在财报电话会提出未来五年云与AI商业化年收入破1000亿美元目标。过去三月,阿里云Token消耗涨6倍,自研芯片交付47万片,还提价。其正从‘用户红利’转向‘Token经济’,有望‘价齐升’。

Founder Park
算法论文8

阿里+清华发现80/20法则:LLM只靠20%的token就能学会Reasoning

阿里与清华研究发现,训练大语言型(LLM)推理时,真正关键的是20%的高熵token,其余80%低熵token几乎无用。仅用20%高熵token做强化学习,效果超全训练,还提出RLVR训练策略提升效率。

深度学习自然语言处理
算法论文8

无需训练的3D生成加速新思路:西湖大学提出Fast3Dcache

在AIGC浪潮中,3D生成型虽进化快,但‘慢’和计算大制约其应用。西湖大学AGI实验室提出无需训练、即插即用的Fast3Dcache框架,能在加速同时保持或提升型几何质

量子位
新闻资讯8

阿里云秘密武器亮相顶会:狂砍82%英伟达,213块GPU干了1192块的活

阿里云与北大合作,由CTO周靖人带队的研究提出GPU池化系统Aegaeon,亮相顶会SOSP。它用token级自动扩缩容技术,将GPU使用从1192个减到213个,提升了资源利用率,还在百炼平台测试成功。

量子位
开源动态8

14B规竟也能单卡实时生成视频?多亏这个强大的开源底座

春节期间 Seedance 2.0 爆火,字节跳动等开源视频型 Helios 家族,参数 14B,单卡生成速度达 19.5 FPS。它与 UniWorld-OSP2.0 技术栈同源,后者是超百亿级视频生成大型,有诸多技术突破。

机器之心
新闻资讯8

西湖大学打造了一个AI科学家,突破人类SOTA,还能自己发论文

西湖大学文本智能实验室推出能自主探索的AI科学家DeepScientist,两周完成人类三年科研。它在三个前沿AI任务刷新SOTA纪录,还能写论文。文中介绍其科研历史、工作方式、成果及面临的伦理问题。

AIGC开放社区