slop 问题」共找到 3196 篇相关文章

产品应用8

MiniMax都在用!5500PB幕后功臣首次亮相,国产黑马祭出杀招

AI浪潮中,数据流不动致GPU算力空转,XSKY星辰天合举办AIMesh产品战略发布会破局。AIMesh含三网,分别解决IO墙、重力墙、内存墙问题,且开放解耦,获多方认可。

新智元
算法论文8

Meta&CMU:Token级LLM协同路由新范式

Meta AI、CMU等联合推出FusionRoute,是让多个大模型在token级协作的新范式。它能在每个token位置精准选专家,自带“急救包”。经实验验证其高效,也指出了待研究的方向。

PaperAgent
推荐文章8

一文搞懂 Agents 评测丨Anthropic 最新万字长文

传统模型评测方法难评估 Agent 系统,Anthropic 摸索出有效评测设计方法。文章介绍评测结构、意义、方法,涵盖编程、对话等 Agent 评测,还给出打造评测路线图及与其他方法结合的建议。

特工宇宙
开源动态7

开源3天斩获 2K Star,这个开源 Skills 技能把 AI 的“记忆缺陷”补上了!

最近含金量极高的 Skills 指南 planning-with-files 开源上线 3 天,GitHub Star 达 2k。它复刻 Manus AI 核心模式,将 Markdown 作为 AI Agent 工作内存,采用三文件模式解决 AI 记忆问题

开源星探
新闻资讯8

黄仁勋CES2026最新演讲:三个关键话题,一台“芯片怪兽”

北京时间1月6日,英伟达CEO黄仁勋在CES2026演讲。回顾过去一年开源模型发展,本次围绕系统与基础设施、模型、应用落地三条主线演讲,展示Rubin架构等成果,推动推理型AI发展及应用。

芯师爷
新闻资讯7

谷歌 Gemini API 负责人自曝:用竞品Claude Code 1小时复现自己团队一年成果,工程师圈炸了!

谷歌主管工程师 Jaana Dogan 称,用竞品 Claude Code 一小时就生成了接近自己团队一年成果的系统。她公开评价引发争议,也让大家思考‘一年工程 vs 一小时生成’背后被压缩的是什么。

AI前线
新闻资讯7

AI Coding 生死局:Spec 正在蚕食人类编码,Agent 造轮子拖垮效率,Token成本失控后上下文工程成胜负手

本文为《2025 年度盘点与趋势洞察》系列之一,聚焦 AI Coding 在程序员群体的演进与落地。探讨了 Spec 驱动开发、Agent 崛起、Token 成本等问题,指出上下文工程是 AI Coding 成败关键。

InfoQ
推荐文章8

深度之赌:从卧室到上帝机器

文章讲述现代AI秘史,从Jeff Dean本科研究神经网络失误,到Google Brain诞生;还有Hinton等深度学习先驱经历,如Hinton当实习生、AlexNet诞生等,也提及Google发展及未先发ChatGPT原因。

宝玉AI
开源动态8

当世界模型不止「视频」该如何评估?WorldLens提出实用化评估新框架

生成式世界模型在多领域进展显著,但评估存在局限。WorldBench 团队构建 WorldLens 评测框架,从五个维度评测开源世界模型,其评测 EvalKit 已公开,可暴露模型能力边界与失效模式。

机器之心
产品应用7

全球功能最全的视频生成模型来了

阿里发布新一代通义万相2.6系列模型,是全球功能最全的视频生成模型,覆盖文生视频等多种模式。它在视频创作和文生图方面能力提升,虽有小瑕疵,但日常短视频和二创已可用。

量子位