「PhyT2V框架」共找到 3398 篇相关文章
Qwen3 变身扩散语言模型?不从零训练也能跑,30B参数创纪录
扩散语言模型(DLM)潜力大但训练难,Radical Numerics团队改造Qwen3-30BA3B,推出30B参数的开源扩散语言模型RND1-Base。该研究系统性研究A2D转换关键因素,成果超现有部分模型,还提出简单方法及训练策略。
蚂蚁Ring-1T正式登场,万亿参数思考模型,数学能力对标IMO银牌
10月14日凌晨,蚂蚁万亿级思考模型Ring-1T正式登场,这是全球首个开源的万亿参数思考模型。它在多项基准测试中表现出色,数学能力达IMO银牌水平,还展示了强大的代码、推理、写作等能力,其背后是IcePop算法与ASystem框架的支撑。
对骂之外,奥特曼正筹划脑机接口新公司,狙击马斯克的Neuralink
山姆·奥特曼正筹划脑机接口公司Merge Labs,对标马斯克的Neuralink。新公司以8.5亿美元估值融资2.5亿,OpenAI或投。此时,二人在X上因苹果推广ChatGPT起争执,脑机接口竞赛也将开启。
小模型大作为!微博的VibeThinker-1.5B超越DeepSeek R1等头部大模型
近年来,“参数越大,能力越强”成行业共识,但带来成本高和资源集中问题。微博AI团队开发的VibeThinker - 1.5B用1.5亿参数和低训练成本,在多项测试中超越头部大模型,还提出SSP框架和MGPO算法。
一家低调的工业AI公司,用TPT跨越生成式AI鸿沟|甲子光年
麻省理工学院报告指出约95%生成式AI企业试点无实质回报,存在生成式AI鸿沟。工业AI落地难,中控技术的TPT及TPT 2模型,在兰州石化榆林化工应用效果好,其优势源于数据和行业经验,也体现了破局决心。
Gemini 3.5 Pro绝密泄露,前端赶超Fable 5!
全网被Gemini 3.5 Pro泄露刷屏,传闻7月17日发布。它在前端生成表现出色,一次成型、精准零失误,性能超Fable 5,但在硬核推理等任务上不如Fable 5和GPT - 5.6。谷歌为其重预训练,还准备对标GPT - Image 2的图像模型。
前钉钉最年轻副总裁的AI冒险:当AI开始“雇佣”人类|甲子光年
前钉钉最年轻副总裁王铭带领攀峰智能K2 Lab获数千万元种子轮融资。其首款产品拟人化商业专家Moras是全球首个面向超级个体的商业化Agent,解决海外达人变现痛点,采用‘底薪+提成’模式,还探索‘AI雇佣人’新商业模式,目标成AI时代的Shopify。
又多了一个哄孩子AI神器,一张破涂鸦竟能秒变迪士尼动画
年轻父母有了哄娃新法子,用AI可将涂鸦变动画。博主用Midjourney将妈妈30年前涂鸦做成动画,还给出提示词框架。介绍即梦、可灵、谷歌Veo3等工具,它们能快速生成音视频,各有优劣。还提到Meta的Animated Drawings玩法。
英伟达揭示RL Scaling魔力!训练步数翻倍=推理能力质变,小模型突破推理极限
学界对强化学习能否让模型学会新推理技能争论已久,过去研究多悲观。英伟达研究指出,问题源于任务在基础模型训练数据中过度呈现及训练步数不足。其ProRL框架提升训练步数,释放小模型潜力,还构建技术组合拳。
新国产GPU「曦望」,刚融了10个亿
国产GPU公司曦望Sunrise由商汤2024年底分拆独立,时隔半年完成近10亿融资。其产品曦望S1、S2已量产,S3在研发。两位联席CEO分别是百度元老王湛和AMD芯片老将王勇,核心团队规模小但成果显著。