能效比」共找到 720 篇相关文章

开源动态8

蚂蚁百灵新一代Ling-3.0开源,智效13.2,124B释放1T能力

蚂蚁百灵新一代模型Ling-3.0开源,有flash和tiny两版本。Ling-3.0-flash参数量124B,智效13.2,输出快成本低;Ling-3.0-tiny参数量7.9B,激活少且适用多场景,二者都极致挖掘模型效率。

AIGC开放社区
算法论文8

韩松等提出FlashMoBA,MoBA快7.4倍,序列扩到512K也不会溢出

今年2月月之暗面提出MoBA,在处理长上下文有潜力,但业界缺乏对其性能设计原则的理解和高效GPU实现。来自MIT、NVIDIA的研究者提出FlashMoBA,解决了小块MoBA性能挑战,实验显示其在多方面表现优。

机器之心
推荐文章8

没有KPI,也能领先OpenAI?从“内部观察者”视角看顶级AI实验室如何运作

InfoQ 采访《哈萨斯:谷歌 AI 之脑》作者塞巴斯蒂安·马拉,从“内部观察者”视角探讨 DeepMind 成长逻辑,分析其与 OpenAI、Anthropic 的差异,指出 AI 竞争已演变为组织模式等方面的长期博弈。

InfoQ
开源动态8

租了8张H100,他成功复现了DeepSeek的mHC,结果官方报告更炸裂

元旦期间,DeepSeek发布的mHC震撼AI社区。FlowMode工程师Taylor Kolasinski租8张H100复现mHC,结果官方报告更优。文章介绍复现实验,对mHC、HC和标准残差结构,揭示超连接在规模化时的不稳定性及mHC的解决办法。

机器之心
算法论文7

研究表明:资深开发者在使用AI工具时,完成任务的时间不使用时延长了19%。

研究通过随机对照试验,发现2025年初资深开源开发者使用AI工具完成任务时间不使用时延长19%。当前衡量AI能力多依赖标准化评测,可能高估或低估其真实能力,研究旨在更准确评估。

宝玉AI
新闻资讯7

OpenAI自研芯片内幕曝光!18个月前开始用AI优化芯片设计,人类工程师更快

OpenAI与博通官宣合作,将共同部署10GW规模AI加速器。双方头头齐聚爆料合作契机与细节,OpenAI总裁称已用AI优化芯片设计,人类工程师更快,且合作已持续约18个月。

量子位
开源动态8

1.8K Star!又挖到一款超酷的 Claude Cowork 开源平替,而且 Cowork 更快更省!

Anthropic 发布 Claude 的 Cowork 能力后成热门,但高额费用和封闭策略让普通人却步。现推荐开源替代方案 OpenWork,它免费开源,速度快、省 Token,还引入安全隔离机制,功能丰富。

开源星探
产品应用8

阿里电影级视频模型万相2.6系列上线,功能Sora2还全,人人都能当导演

12月16日,阿里发布通义万相2.6系列模型,5款新模型同时上线,覆盖图像到视频多环节。它是国内首个支持角色扮演的视频模型,功能Sora2全,已上线阿里云百炼和万相官网。

AI前线
算法论文8

人类专家快2倍,斯坦福联合英伟达发布TTT-Discover:用「测试时强化学习」攻克科学难题

斯坦福与英伟达等机构联合提出 TTT - Discover 方法,让 LLM 在测试时强化学习。它在多任务上成绩出色,如在数学、GPU 内核等领域超越人类和其他 AI,计算成本低,或为持续学习打开新空间。

机器之心
产品应用8

劈柴哥和哈萨斯亲自站台!谷歌世界模型Project Genie刷屏,幕后团队揭秘60秒不是极限,内存是巨大约束

谷歌发布世界模型原型 Project Genie,用一句话或图就能生成可玩交互的实时虚拟世界,由劈柴哥和哈萨斯站台。它基于 Genie 3、Nano Banana Pro 和 Gemini 构建,解决了世界模型长期以来的短板,目前处于实验阶段。

InfoQ