新词新站理论」共找到 4001 篇相关文章

新闻资讯7

Anthropic模型偷「吃瓜」!最强Fable 5爆冷

Anthropic提前曝光两个模型claude-mashmallow-eap和claude-melon-eap,早期实测Marshmallow更佳。此前上线的最强Fable 5爆冷,企业调用少,营收低,其弟Opus 5反而胜出,开源模型也在抢占份额。

新智元
新闻资讯7

刚刚,DeepSeek模型MODEL1曝光,3处架构升级!

DeepSeek更FlashMLA时曝光模型MODEL1,从diff看它在MLA KV-Cache存储与访问方式上和V3/V3.2系列有3个本质差异,如物理排布更紧凑、引入‘extra’两段式cache、头维固定512×512。

PaperAgent
开源动态8

Sand.ai重磅更MagiAttention,正在定义分布式Attention性能标杆

2025年4月,Sand.ai开源MagiAttention v1.0.0。如今发布v1.1.0,适配Blackwell架构,构建原生Group Collective原语,经系统级协同优化,在多模型训练中得到实证,展现卓越性能。

机器之心
算法论文8

谷歌研究:大模型“吵架”有利于提升推理质量

谷歌研究发现高级推理模型自发进化出'思想社会',研究人员用LLM - as - judge方法识别出多个虚拟人格。还找到控制现象的'开关',实验表明教AI'吵架'更有效,其'社交技能'通用,给开发者带来启示。

AI工程化
推荐文章7

我写 nano banana pro 提示时的原则和策略

作者分享写 nano banana pro 提示的原则与策略,原则是做成模板、结合模型能力;策略是先跑通原型再抽象成模板;不过度精简提示,还介绍用 GPT-5.1 等工具辅助。

宝玉AI
算法论文8

模型「漂移」范式,何恺明作让生成模型无须迭代推理

训练生成模型复杂,传统扩散模型训练费时费力。何恺明团队提出「漂移模型」范式,不依赖微分方程,支持一步推理,实验验证其在多领域性能佳,有望解决生成式AI质量与效率权衡问题。

机器之心
新闻资讯7

晋诺得主警告:别做梦了,AI难有「经济奇点」!

晋诺奖得主Philippe Aghion早在2017年就剖析AI对就业与增长的影响,强调它并非奇点催化剂,而是受「鲍莫尔成本病」制约的工具。他认为AI是自动化进程的最形态,其对经济增长的促进作用或受限。

新智元
推荐文章8

别再用提示去 AI 味了,方向就是错的

当下“去AI味”需求大,但用提示去AI味是错的。原因有产出内容同质化、提示一次性、未告知AI具体风格。作者提出写作风格Skill方案,介绍了制作步骤、模板及与其他技能的组合。

宝玉AI
算法论文8

用大模型检测工业品异常,复旦腾讯优图算法入选CVPR 2025

AI模型用于工业异常检测获SOTA,相关论文中稿CVPR 2025。复旦大学、腾讯优图实验室等机构研究人员设计基于扩散模型的少样本异常图像生成模型DualAnoDiff,实验显示其性能更优。

量子位
新闻资讯7

Andrej Karpathy:“ChatGPT套壳”的说法大错特错,提示工程已过气

Andrej Karpathy力挺用“上下文工程”取代“提示工程”,指出“提示”过于简单,“上下文工程”更能揭示构建强大AI应用的本质。他强调“上下文工程”仅是构建大模型应用的一环,“ChatGPT套壳”说法大错特错。

AI寒武纪