LLaDA2.1」共找到 3267 篇相关文章

开源动态8

CapRL:用强化学习突破Image Captioning训练瓶颈,3B模型性能媲美72B

上海人工智能实验室联合团队发布 CapRL,首个将 DeepSeek - R1 强化学习策略用于 Image Captioning。CapRL - 3B 模型在图像描述任务媲美 Qwen2.5 - VL - 72B,已开源,团队持续迭代优化。

OpenMMLab
算法论文7

大模型“记性差一点”反而更聪明!金鱼损失随机剔除token,让AI不再死记硬背

马里兰大学等团队提出金鱼损失法,训练时随机剔除部分token,让模型不逐字记内容,仍学语言规律。实验显示,LLaMA - 2用该方法后记忆内容减少,下游任务性能影响小。

量子位
新闻资讯7

谷歌深夜放出 IMO 金牌模型,多项测试力压 Grok 4、OpenAI o3!网友评论两极分化

8月1日晚谷歌向Ultra订阅用户推Deep Think功能,Gemini 2.5 Deep Think模型在IMO夺冠。它是多智能体模型,能并行处理问题。多项测试中表现优于Grok 4、o3,不过网友评价不一。

AI前线
开源动态8

模型、代码、数据全开源!轻松训练自己的垂类Agent!

Together AI联合Agentica推出`DeepSWE-Preview`,基于开源Qwen模型,用RL在SWE - Bench - Verified登顶。团队将模型权重、训练框架等全开源,抛弃SFT纯用RL训练,还分享训练秘籍和TTS技巧,为垂类Agent训练提供新范本。

探索AGI
推荐文章7

OCR-Reasoning:揭秘多模态大模型在复杂图文推理中的真实能力

主流OCR评测基准聚焦信息抽取,复杂图文推理任务中多模态大模型深度推理能力缺乏评估标准。OCR - Reasoning可系统性评估,还列举多种推理示例,并测评了Qwen2.5 - VL - 7B模型。

CourseAI
新闻资讯7

特斯拉终于着急了

特斯拉交出史上最差季报,净利润暴跌、汽车收入骤降。其处于从汽车向人工智能转型过渡期,却面临汽车业务疲态、AI业务落地难的问题,如Cybertruck和Model 2/Q未达预期,资本市场耐心受考验。

远川科技评论
产品应用7

变天了!WindSurf推出workflow功能,低代码大模型应用开发平台将面对“降维”打击

Windsurf在1.8.2版本推出workflow功能,其采用自然语言定义工作流并与开发IDE深度集成,是更高级形态。该功能特性丰富、应用场景多,对Dify等应用编排工具或造成‘降维打击’。

AI工程化
产品应用7

实测美团 LongCat:快到极致,但是别说追平 DeepSeek

AI科技评论实测美团LongCat-Flash-Chat,它是中量级对话模型,主打“快”,几乎零延迟。但在推理、抗污染能力等测试中,相比DeepSeek-V3.1,逻辑链条松散,缺乏清晰判断。速度与逻辑哪个更重要,值得思考。

AI科技评论
产品应用8

刚刚,好莱坞特效师展示AI生成的中文科幻大片,成本只有330元

AI领域发展迅速,视频生成能力提升。百度全球首发中文音视频一体化模型百度蒸汽机2.0,实现人物口型等毫秒级同步,多版本升级且价格有竞争力。实测效果好,技术上解决难题,还开创应用驱动研发范式。

机器之心
新闻资讯7

GPT-5刚刚正式发布,首次面向免费用户开放

OpenAI正式发布GPT - 5,有架构统一、性能大幅提升、全用户开放三大核心变化。测试数据显示性能进步明显,采用新定价策略面向所有用户开放。但演示未带来突破感,编程能力还面临Claude Opus 4.1挑战。

AI工程化