LLaDA2.1」共找到 3274 篇相关文章

新闻资讯7

悬赏5000刀!148局AI斗蛐蛐世界杯官方战报出炉,全球赛邀你接棒来战

淘宝举办AI大模型斗蛐蛐世界杯,将12个顶尖模型放同一Agent框架,在12人局技能狼人杀场景对战150局。截至148局,谷歌两模型暂居前二,Qwen3-Max-2026-01-23排第三。还开启WhoisSpy国际赛,开发者可参与,前十有奖励。

量子位
新闻资讯8

弯道超车?国产具身,千小时人类数据激发智能涌现

近日,深度机智用人类学习范式在国际 Benchmark 上击败巨头,成果两会首日被央视报道。其全新架构源于一年多积累。英伟达也有人类学习尝试。深度机智构建全栈技术矩阵,成果显著,3 月底成果将开源。

机器之心
新闻资讯7

Claude被美封杀后,Anthropic CEO回应一切!

2025年7月Anthropic与五角大楼签2亿美元合作合同,因提出AI不得用于全自主武器及大规模国内监控遭拒。美国防部长称其技术有“国家安全供应链风险”,Anthropic CEO回应坚持红线是捍卫美国价值观。

AI科技大本营
算法论文8

震惊!如果AI掌控核按钮,95%的情况它会按下去

伦敦国王学院研究者让GPT - 5.2、Claude Sonnet 4和Gemini 3 Flash三款模型模拟核危机博弈。不同时间框架下模型表现不同,还展现复杂战略推理能力,95%对局用了战术核武,暴露诸多问题。

AIGC开放社区
新闻资讯7

我用AI做了个付费榜第一的App,现在人民日报管这叫「手搓经济」

人民日报提出「手搓经济」,指个人开发者用AI做出的应用受青睐。作者作为亲历者,认为报道判断准,但应注意手搓动机是创造、参与者不止年轻人,且产品从1到100仍需投入。

花叔
算法论文7

VL-LN Bench:模拟「边走边问找具体目标」的真实导航场景

上海人工智能实验室等研究者完成VL - LN Bench,模拟真实导航场景。它构建自动化数据收集管线,依托InternVLA - N1训练评测。结果显示主动对话可提升表现,但当前方法在实例感知对齐等环节有短板。

机器之心
新闻资讯8

Sam Altman与开发者的一小时对话:我们在“梦游般”走向风险,人类经不住Agent诱惑

Sam Altman在与开发者生态交流会上,针对GPT-5写作能力下降问题坦率回应,还发出一系列重磅信号,如警告生物安全风险、披露招聘计划等,并就软件工程、AI Agent等多个话题分享看法。

AI寒武纪
算法论文8

Gemini准确率从21%飙到97%!谷歌只用了这一招:复制粘贴

Google Research研究发现,将输入问题复制粘贴一遍,能让大模型在非推理任务上准确率惊人提升,如Gemini 2.0 Flash - Lite从21.33%升至97.33%,且几乎不影响生成速度,但不适用于推理场景。

新智元
产品应用7

没KPI反而爆了?Cursor大神一人敲出核心功能!CEO上手7天不宕机,AI编程玩法全变了

昨日,Cursor的CEO基于GPT - 5.2构建了超300万行代码的浏览器,具备基础可用性。同时,Cursor工程负责人在访谈中分享了编码Agent发展、Cursor使用方式、未来方向等多方面内容,还揭秘团队工作模式。

AI前线
算法论文8

不止于量化:最新综述用「时-空-构」三维视角解构KV Cache系统级优化

随着LLM向1M上下文演进,KV cache成推理服务效率核心瓶颈。墨尔本大学和华中科技大学研究者发布深度综述,用「时间 - 空间 - 结构」视角梳理KV cache优化方法,还归纳关键观察、提出开放挑战,并整理了资源库。

机器之心