R1模型」共找到 8455 篇相关文章

产品应用8

真正的一句话修图:Gemini 用香蕉模型给出了图像生成的分水岭

Google新模型Gemini 2.5 Flash Image可在AI Studio体验。它有多图融合、角色一致性等能力,能实现自然语言编辑图像,速度快、价格低、API可用,虽有中文体验等问题,但有望让AI视觉工具进入工程化时代。

MacTalk
新闻资讯8

马斯克Grok 4.1双冠封王,爆冲第一!AI王座一夜易主

马斯克携xAI推出Grok 4.1并免费开放。它在LMArena和EQ - Bench登顶,写作Elo提升600分、幻觉率降3倍。后训练RL规模扩大,还经盲测评估,在多方面表现出色。

新智元
开源动态7

24张图,从GPT-2到gpt-oss,看OpenAI开源模型技术演进

2025年8月OpenAI释出gpt-oss-20b与gpt-oss-120b两个开源权重模型。文章梳理了从GPT - 2到gpt - oss的技术演进,拆解关键创新点,对比了与Qwen3的差异,介绍训练推理细节、实测体验及与GPT - 5跑分对比情况。

PaperAgent
产品应用8

全球首个通用决策大模型,AI推演现实世界的技术揭秘

中科闻歌决策机Decitron被称为「全球首个通用决策大模型」,它将不同能力统一到开放世界决策框架,形成闭环。8月3日其技术报告发布,公开三项核心技术,还介绍了推演流程和实验验证情况。

机器之心
产品应用7

阿里QwenLong-32B:1W+超长Token推理,知识密集型复杂文档高效推理

文章介绍阿里QwenLong - 32B在长文本推理的能力。长文本推理有训练效率低和优化不稳定问题,QWENLONG - L1通过强化学习等解决,还阐述其组件、训练步骤,并给出实战代码及相关链接。

CourseAI
产品应用8

聚焦手机AI“超级入口”,中兴Nebula小模型让手机秒变“小秘”?

移动智能时代,手机AI“超级入口”成竞争焦点。美团率先推出AI Agent,中兴通讯自研Nebula-GUI模型表现亮眼,在测评中获佳绩,已在多款手机商用,还开发数据制备系统,经监督微调、双层强化学习提升性能。

量子位
推荐文章7

Manus 加入 Meta,1 年内公司价值 100 倍增长,他们做对了什么?

Manus 加入 Meta 后公司价值一年涨百倍,其虽无自有模型却受海外巨头青睐。它靠增量思维获产业认可,借先发红利快速获高 ARR 与估值。后续应塑造爆款场景,创业者和大厂都可借鉴其思路。

Founder Park
算法论文8

最具争议性研究:大模型中间层输出可 100% 反推原始输入

意大利罗马第一大学GLADIA Research Lab论文提出主流Transformer语言模型信息处理几乎不丢内容,是可逆的。实验验证其单射性,SIPIT算法能100%重建输入。研究有新视角,但也引发讨论。

AI科技评论
新闻资讯8

OpenAI新模型让数学家集体破防?一场关于数学未来的精神危机

OpenAI下一代主要模型Astra内部版本在多数学领域给出十项新研究结果,让数学界震动。数学家看法不一,有人惊叹,有人迷茫,还有文章指出这或引发数学学科意义的精神危机。

机器之心
开源动态7

DeepSeek新模型DeepSeek-V4-Lite-285B测试曝光:“大海捞针”召回率100%

社区消息显示DeepSeek正测试新模型DeepSeek - V4 - Lite - 285B,用OpenAI MRCR 8 - pin标准考察超长上下文信息检索能力。测试结果优异,但‘大海捞针’法或被DSA作弊,实际效果存疑,社区高度关注其进展。

AI工程化