LLaDA2.0」共找到 2458 篇相关文章

开源动态8

又一个Kimi K3下周开源!Qwen3.8-Max编程、办公、科研都能自己干了

Qwen3.8-Max是Qwen家族迄今最强模型,2.4万亿参数,下周将开源权重。它在多项基准测试中表现出色,能连续自主工作数天,在编程、办公、科研、长周期任务、多模态等方面全面提升。

AIGC开放社区
推荐文章8

揭秘大模型Steering:从底层机理到系统评估,全面破解大模型行为控制之谜

近期《Science》研究表明可解析AI内部表征实现通用引导与监控。浙大联合阿里两篇ACL 2026主会论文,揭示Steering工作原理与能力边界,还开源一站式框架EasyEdit2,全面展示了Steering价值。

机器之心
开源动态7

缓存命中率99.93%!DeepSeek最适合的Harness来了,GitHub狂揽8.6万Star

DeepSeek官方版Harness未出,民间开源编程Agent「Pi」先火。它适配DeepSeek,让其缓存不命中率低至0.03%,调用成本大降。Composio测试显示Pi完成任务平均成本最低。同时,DeepSeek正组建团队做官方Harness。

量子位
开源动态8

硅谷豪赌算力烧到停电,中国团队反向出击!这一刀,直接砍碎Scaling Law

硅谷陷入算力战争,OpenAI、马斯克等豪赌Scaling。但Anthropic指出模型大、算力多不一定聪明。Yuan 3.0 Flash登场,用RAPO+RIRM解决过度思考,降低推理token,在多模态任务表现出色,引发开发者关注。

新智元
推荐文章7

完美解决Clawdbot巨额消耗,教你用国产模型实现7*24不停机使用,成本降低10倍。

文章介绍Clawdbot玩法爆火,因名称被指控侵权改名moltbot。重点给出实操干货,解决连接和成本问题,推荐用MiniMax M2.1模型搭配,还介绍接入飞书方法及该模型5大优势。

开源AI项目落地
新闻资讯8

万字长文梳理「罗福莉」三个半小时的访谈:2026年不是Agent元年,是生产力爆发年

小米大模型负责人罗福莉在访谈中复盘技术剧变,分享对OpenClaw的认知转变,阐述Agent框架本质,介绍MiMo V2架构选择,探讨人跟Agent共创、多模态Agent等内容,判断2026年生产力将爆发。

开源AI项目落地
产品应用8

谷歌首个原生多模态向量模型发布:Agent 可以用文字搜图片、用图片搜视频了...

谷歌推出首个原生多模态嵌入模型Gemini Embedding 2,通过Gemini API和Vertex AI公开预览。它将文本、图像等映射到统一向量空间,支持多模态交错输入,性能超越现有领先模型,开发者可快速接入。

AI寒武纪
算法论文8

清华刘知远团队论文:最小化结构改动,短文本到长文本丝滑升级 | ICLR 2026

大语言模型发展中,上下文长度成关键瓶颈,主流架构计算开销大。清华刘知远团队提出《InfLLM-V2: Dense-Sparse Switchable Attention for Seamless Short-to-Long Adaptation》,提出可切换注意力框架,为长上下文研究提供新思路。

AI科技评论
产品应用8

字节Seed最新版原生智能体来了!一个模型搞定手机/电脑/浏览器自主操作

字节Seed发布最新版原生智能体UI - TARS - 2,采用All in one原生设计,表现优于Claude和OpenAI Agent等。它通过多轮强化学习,解决智能体操作图形界面的四大难题,在多测试中表现出色。

量子位
推荐文章7

简单了解下CUDA Green Context

文章基于Flashinfer实现介绍CUDA Green Context,它在CUDA 12.0+引入,能实现资源隔离、降低多线程性能损失、提高GPU使用率。还给出使用方法及代码示例,不过测试性能未达预期,需关注后续发展。

GiantPandaLLM