算力 - 算法一体化」共找到 1363 篇相关文章

产品应用8

可灵3.0系列模型正式上线:属于每个人的导演时代来临

可灵AI正式全球上线3.0系列模型,覆盖影视级全流程链路。该系列基于All-in-One理念构建,解决了行业一致性等问题,在多方面做了增强,完成从单点生成到专业调度的跃迁,让AI成创作协作者。

AI科技评论
新闻资讯7

语言模型内部还藏着众多策略模型?自底向上强化学习重塑底层特征 | 直播预约

现有强化学习工作将语言模型作整体策略优化,研究提出以策略视角审视内部隐藏状态,分析层级和模块级策略,发现不同模型模式差异,还提出自底向上强化学习策略,为研究架起新桥梁。

深度学习自然语言处理
新闻资讯8

ChatGPT强行上马广告,因为OpenAI真的太烧钱

ChatGPT宣布上线广告后评论区骂声一片,OpenAI财务困境明显,预计2025年烧钱超80亿美元,2028年达400亿美元。广告是其商业战略一部分,后续还会通过多种方式推动收入增长。

量子位
开源动态8

把RoPE扔掉,AI更能看懂长上下文!Transformer作者团队开源大模型预训练新方法

Transformer架构核心作者之一Llion Jones团队开源新技术DroPE,可丢弃位置嵌入扩展上下文,解决RoPE长序列处理缺陷,在多模型实验中表现卓越。该团队来自Sakana AI,此前还有相关研究成果。

量子位
开源动态8

让本地大模型不再重复推理的缓存技巧

本地跑大模型时,同样问题换说法问,模型又要重新推理。`constraint-cache`这个Python库可解决此问题,它将语义相似查询规范化为统一缓存键,实现近乎即时的重复查询响应,还避免了随机性响应问题。

AI工程化
新闻资讯7

独家丨MiniMax 高级研究总监钟怡然已于半年前离职

AI 科技评论独家获悉,MiniMax 高级研究总监钟怡然已离职,去向未公开。他曾主导设计 MiniMax - 01,该模型在超长上下文处理能力上表现突出,走出独特架构创新与效率优化路径。

AI科技评论
新闻资讯8

红杉美国:未来一年,这五个 AI 赛道我们重点关注

红杉资本分享未来 AI 投资判断,认为 AI 革命堪比工业革命,蕴含 10 万亿美元机遇。未来 12 - 18 个月,将重点关注持久化记忆、通信协议、AI 语音、AI 安全和开源 AI 五大主题,这些也是创业好赛道。

Founder Park
新闻资讯8

semianalysis 长文 | 关于Meta 砸钱、抢人、领导力、建帐篷、计算、数据和超级智能

Meta在基础模型性能落后,扎克伯格亲自挂帅开启AI军备竞赛。他砸钱收购、挖人、堆算力,建GPU集群,还面临Llama 4失败问题,试图通过一系列举措追赶超级智能。

AGI Hunt
新闻资讯7

通往 AGI 之路的苦涩教训

Google DeepMind CEO 预测 5 到 10 年有 50% 概率实现 AGI。本期《万有引力》直播对话将探讨通往 AGI 之路的教训。6 月 27 日,唐小引将对话刘嘉,从其学术轨迹解答 AI 路上的教训,还会剖析技术路径。

AI科技大本营
开源动态8

不用千亿参数也能合成高质量数据!这个开源框架让小模型“组团逆袭”,7B性能直追72B

上海人工智能实验室与中国人民大学提出GRA框架,以“多人协作”理念让小模型分工生成高质量训练数据。实验显示其生成数据质量高,项目已开源。它打破对大模型蒸馏依赖,展现“集体智能”潜力。

量子位