LLaDA2.1」共找到 3267 篇相关文章

产品应用8

每帧Sora级震撼!Midjourney首个视频模型登场,超逼真大片首测来袭

Midjourney首个AI视频模型V1上线,每月10美金可体验20秒。其视觉效果惊艳,能媲美Sora等,还能一键让图像动起来。成本低,提供多种模式与设置,有技术愿景,未来将完善模块。

新智元
开源动态8

阿里开源长文本深度思考模型!渐进式强化学习破解长文本训练难题,登HuggingFace热榜

阿里开源长文本深度思考模型QwenLong - L1,登上HuggingFace热门论文第二。它解决了长文本强化学习训练难题,通过渐进式上下文扩展训练,在多基准测试中表现出色,还探讨了SFT和RL作用。

量子位
开源动态8

这个项目专治建模手残党,给张图就能转变可编辑能转动的3D模型

img2threejs上线11天获4.8k Star,专治建模手残党。给它一张图,它让AI写代码把物体“搭”出来,不重建几何,也不下素材包,还省Token、零依赖,有严格质量门控。

GitHubStore
开源动态7

OpenClaw 之后,Agentic RL有了新训练范式

大模型技术推动AI从‘回答问题’迈向‘执行任务’,Agentic AI兴起。中国科大认知智能全国重点实验室提出Claw - R1项目,将前沿Agent Runtime与强化学习训练框架结合,为Agentic AI提供新训练基础设施。

PaperAgent
新闻资讯7

谷歌、OpenAI同日发布模型,一个最快最具性价比,一个主打「人情味」

深夜谷歌和OpenAI相继推出新版本大模型Gemini 3.1 Flash - Lite、GPT‑5.3 Instant。前者专为大规模智能设计,性价比高、速度快;后者让日常对话更稳定实用,减少幻觉,提升了多方面表现。

机器之心
产品应用8

马斯克视频生成模型首次交卷!电影级运镜+音效,免费可玩

xAI的“迄今为止最强大的视频音频生成模型”Grok Imagine 1.0正式全面上线。该模型支持文生视频、图生视频,音频效果出色,还擅长日常趣味创作。其在视频生成和剪辑性能领先,官网可免费玩。

量子位
新闻资讯7

官宣!姚顺雨出任腾讯首席AI科学家,带队大语言模型、AI Infra

12月17日腾讯官方消息,腾讯升级大模型研发架构,新成立AI Infra部等。姚顺雨出任首席AI科学家,兼任AI Infra部、大语言模型部负责人,他在智能体方向成果多,论文总引用超1.9万。

机器之心
新闻资讯7

前端和后端谁先死?

GPT - 5.1、Gemini 3、Claude Opus 4.5 发布后,都引发前端要死的说法。有截图称前端需全部转型,某大厂前端专家认为这是被自媒体洗脑,还觉得 AI 更易颠覆 CRUD 的后端。

AGI Hunt
算法论文8

谢赛宁团队用RAE实现从8%到84%的飞跃,宣告VAE时代结束

谢赛宁团队用RAE新架构将ImageNet图像生成FID刷到1.13,宣告VAE组件过时。RAE结合先进表征学习成果与强大生成模型框架,解决诸多问题,还为其高维潜空间定制DiTDH架构,性能优异。

AIGC开放社区
算法论文8

LLM协作告别文本形式:直接“脑对脑”,Cache-to-Cache实现语义瞬时传输

现有多LLM系统依赖文本通信,效率低且易失真。论文提出Cache - to - Cache(C2C)范式,让LLMs通过KV - Cache“脑对脑”交流,实现高效精准语义传输,在多类任务中提升性能与效率。

深度学习自然语言处理