投稿量」共找到 691 篇相关文章

开源动态8

没想到,最Open的开源新模型,来自小红书

向来低调的小红书昨日开源首个自研大模型 dots.llm1,它是中等规模的 MoE 模型,在较小激活下性能良好。其开源力度堪称行业最大,还介绍了数据处理、训练优化等多方面技术细节。

机器之心
推荐文章8

近期必读,Mary Meeker 340页PPT分析AI现状和未来

Mary Meeker发布340页《人工智能趋势报告》,分析AI现状与未来。报告指出AI发展迅速,用户、使用和资本支出增长前所未有,但也面临变现威胁,如竞争加剧、开源模型崛起和中国追赶,同时AI正深刻改变工作方式。

歸藏的AI工具箱
算法论文8

单卡即可微调大模型!内存占用仅1/8,性能依然拉满 | ICML 2025

基础大模型应用于下游任务时微调成本高,低秩适应(LoRA)方法虽降低成本,但性能不及全微调。华中科技大学和香港中文大学团队提出GOAT框架,在25个多领域任务验证效果好,内存占用仅1/8。

量子位
产品应用7

浅析 Amazon S3 Files:工作机制、性能边界与选型思路

4月7日,AWS发布新服务Amazon S3 Files,可将S3存储桶作为高性能共享文件系统挂载到计算节点。本文分析其底层实现、工作机制、性能边界,与其他对象存储文件化方案对比,指出适用场景。

InfoQ
算法论文8

POF | 上海理工大学梁梓浩、朱兵等:使用大语言模型进行气泡湍流实验数据处理

本文提出结合大语言模型(Time - LLM)与Transformer模型的复合框架处理气泡两相流热膜测信号干扰。先由Time - LLM识别气泡干扰信号,再用Transformer模型修复。实验证明该方法高效、轻且物理自洽。

力学与人工智能
开源动态8

里程碑时刻!首个100B扩散语言模型来了,技术报告揭秘背后细节

蚂蚁集团与高校联合团队推出 LLaDA2.0 系列扩散语言模型,其中 LLaDA2.0 - flash 参数达 100B。技术报告披露细节,其解决了 dLLM 做大做强难题,性能比肩 AR 模型,为扩散模型工业化带来转机。

机器之心
产品应用8

Meta「分割一切」进入3D时代!图像分割结果直出3D,有遮挡也能复原

Meta MSL实验室发布三维重建模型SAM 3D,其家族的两个新模型能将2D图像转为3D重建模型,性能优异。同时,此前投稿ICLR 2026的SAM 3也亮相,可克服传统模型局限,在多项任务中刷新SOTA。

量子位
推荐文章8

大厂CIO独家分享:AI如何重塑开发者未来十年

阿里云智能集团副总裁、CIO蒋林泉分享AI时代开发者发展。他指出不能用旧有标准评判价值,探讨技术贡献衡、全栈工程师、提效顺序等问题,强调AI可助力学习和角色创新,还提及招人看重的能力和心性。

InfoQ
新闻资讯7

现在整个AI投资逻辑都错了!微软CEO首次承认:成排的H100正在积灰,插不上电

微软CEO称AI行业投资逻辑有误,瓶颈已从芯片变为电力。微软大H100因缺电力设施闲置,按芯片采购为公司定价的模型是错的。真正赢家是早锁定电力协议的玩家,竞争护城河已改变。

AI寒武纪
开源动态8

一句话搞定后端?揭秘被 52.1k 开发者选择的 PocketBase:真能让你 0 运维快速上线产品吗?

PocketBase是“把后端打包成一个文件”的开源项目,既可以作为独立的轻后端服务直接运行,也能作为Go库嵌入到应用中。它能解决团队做MVP等遇到的痛点,有诸多核心功能和技术优势。

小华同学ai