「预训练框架」共找到 3486 篇相关文章
V0 模型直接进驻 Cursor,UI 生成效果炸裂,氛围编码体验再升级。
AI 编码赛道竞争激烈,Vercel 的 V0 发布 AI 模型,可在 Cursor 中使用,还推出新工作流提升 UI 生成效果。文中介绍了 V0 特点、Cursor 设置方法及使用演示,还分析了 Vercel 自研模型的原因。
DeepSeek用的GRPO有那么特别吗?万字长文分析四篇精品论文
文章解读 Kimi k1.5、OpenReasonerZero、DAPO 和 Dr. GRPO 四篇论文,分析 DeepSeek R1 里 GRPO 及改进算法。指出 GRPO 非特殊 RL 算法,当前 RL 算法实现相似,变革聚焦价值函数取舍等核心维度。
一场对话,我们细扒了下文心大模型背后的技术
信通院大模型推理能力评估中,文心X1 Turbo获最高级“4+级”。百度AI Day上,副总裁吴甜解析文心4.5 Turbo和文心X1 Turbo,从多模态、深度思考等方面介绍技术,还展示其在多场景应用成果。
三金,又是中国队!全球机器人视触融合挑战赛揭榜
ManiSkill - ViTac 2025视触觉融合挑战赛揭榜,全球42支团队参赛,中国两家具身初创公司包揽三金。该赛事聚焦视触觉融合技术,为机器人行业搭建从实验室到现实应用的桥梁,推动相关算法和硬件进步。
Astra 的 Computer Use 能力是如何实现的?
本文编译自Browserbase增长工程师Kyle Jeong的个人博客,对比了纯视觉路线Computer Use模型的缺陷,详细拆解Astra模型利用无障碍树结合Codex Harness实现能力的架构、训练方法,分析其优劣与行业价值。
Meta新模型逼平Fable 5,小扎:开源且便宜到你懒得算账
Meta推出新模型Muse Spark 1.3,在Artificial Analysis榜单中与Fable 5打平手。小扎称其在Coding和Agent工作有大幅提升,还便宜。网友实测它真能肝、真能省,Meta团队核心研究员也透露背后改动。
全球首个通用决策大模型,AI推演现实世界的技术揭秘
中科闻歌决策机Decitron被称为「全球首个通用决策大模型」,它将不同能力统一到开放世界决策框架,形成闭环。8月3日其技术报告发布,公开三项核心技术,还介绍了推演流程和实验验证情况。
都在问世界模型怎么落地,PixVerse把答案做成了「好玩」
互动式娱乐市场正在爆发,PixVerse推出实时视频世界模型R2版本。该版本让用户真正和世界交互,解决实时视频世界模型持续scaling问题,从内测case来看玩法丰富,其底层技术也有大幅改进。
AI不是比人聪明,是输得起!菲尔兹奖得主点破OpenAI十项成果
OpenAI发布内部版模型Astra的十项成果,引发数学界震动。菲尔兹奖得主Timothy Gowers分析其成果,指出AI优势在‘输得起’,还探讨找例方法、模型短板,给出训练建议与衡量跨越门槛的标准。
寻明生科获1亿美元B轮融资,加码基座模型开拓AI药物发现新边界 | 5Y News
近日,寻明生科宣布完成1亿美元B轮融资,累计近2亿美元。资金将投入生物基座模型研发与规模化训练,升级Lab - in - the - Loop体系。该公司构建闭环AI原生基础设施,其模型能力获验证,商业变现多元。