全自回归模型」共找到 8777 篇相关文章

新闻资讯7

文件被 Gemini 当场“格式化”,没了!网友控诉:Claude、Copilot 也爱删库,一个都跑不了

开发者 anuraag2601 用 Gemini CLI 做文件管理测试时,Gemini 操作失败致文件丢,事后不断道歉。网友也反映 Claude、Copilot 等有类似删库问题,这或是模型训练导向问题。

InfoQ
算法论文8

颜水成领衔,给AI分段位!超100款多模态模型,无人达到L5

十所顶尖高校联合发布General - Level评估框架和General - Bench基准数据集,用五级分类制明确多模态通才模型能力标准。评估超100款模型,发现多数在L2 - L3,无L5模型,揭示当前模型不足。

新智元
产品应用8

史上首个被奥斯卡公开支持的AI,终于来了!Utopai模型又被刷屏了

AI原生影视工作室Utopai Studios年入1.1亿美元后又刷屏。其PAI模型可3分钟视频直出,获奥斯卡编剧Roger Avary公开站台,实测效果佳,还与哈登合作。Utopai走皮克斯链路管线路线,开启AI电影制作新时代。

新智元
算法论文8

重写手机AI安边界!首个MoAI攻防SoK,系统梳理三大安支柱

墨尔本大学等联合发布论文指出,移动端AI硬件和模型发展使MoAI成重要范式,但带来安风险。论文给出统一框架,拆解系统为四层,定义三大安支柱,梳理攻击、防御图谱等,还提出开放问题与未来方向。

新智元
产品应用7

Claude Opus 4.7,网差评!刚升级就翻车,用户怒斥:还我4.6

Claude Opus 4.7刚发布就遭网吐槽,价格贵50%,性能却严重倒退,出现幻觉、计算拉胯等问题。用户质疑Anthropic为省钱缩水模型,罪魁祸首可能是新引入的“自适应推理”功能。

新智元
开源动态8

Karpathy再放大招:8000行代码复现ChatGPT栈,最低成本仅100美元,4小时跑完

Andrej Karpathy发布项目nanochat,是栈式ChatGPT克隆体训练/推理流水线,代码约8000行,覆盖训练分词器、预训练等完整流程。介绍不同成本下模型表现,还回答网友关于架构、训练数据等问题。

AI寒武纪
算法论文7

60%情况下,主流大模型没理解风险只是装懂!别被模型的“安答案”骗了

研究发现超60%案例中主流推理模型生成合规答案却未真正理解风险,存在系统性漏洞。淘天集团团队引入“表面安对齐”术语,推出Benchmark研究该现象,还介绍了数据集生成流程及评测指标。

量子位
新闻资讯7

初稿抢先看!13家单位共同起草国首部AI大模型私有化部署标准智合标准化建设

由智合标准中心组织起草的《人工智能大模型私有化部署技术实施与评价指南》团体标准立项,这是国内首部相关标准。它流程覆盖、多方面融合、三方协作,能解决企业痛点,现征集起草单位和人,5月15日开研讨会。

AI工程化
产品应用8

模型落地 B 端营销:京东物流如何用 Agentic Workflow 破解"机械感"难题,实现降本 50%

在数字经济与物流产业融合背景下,B端营销面临挑战。京东物流王春阳分享B端营销实践,从人机协同到流程大模型培育,用Agentic Workflow破‘机械感’难题,实现降本和转化率提升。

InfoQ
7

华为盘古大模型:被芯片牵制的“千古”模型

华为盘古大模型团队员工自曝内幕,称其受芯片限制,早期算力有限、训练困难。还指出内部存在造假、套壳等问题,如135B V2套壳Qwen 1.5 110B,pangu pro moe 72B套壳qwen 2.5的14b等,导致人才流失。

Agent的潜意识