「新词新站理论」共找到 4001 篇相关文章
Anthropic新模型偷「吃瓜」!最强Fable 5爆冷
Anthropic提前曝光两个新模型claude-mashmallow-eap和claude-melon-eap,早期实测Marshmallow更佳。此前上线的最强Fable 5爆冷,企业调用少,营收低,其弟Opus 5反而胜出,开源模型也在抢占份额。
刚刚,DeepSeek新模型MODEL1曝光,3处架构升级!
DeepSeek更新FlashMLA时曝光新模型MODEL1,从diff看它在MLA KV-Cache存储与访问方式上和V3/V3.2系列有3个本质差异,如物理排布更紧凑、引入‘extra’两段式cache、头维固定512×512。
Sand.ai重磅更新MagiAttention,正在定义分布式Attention性能新标杆
2025年4月,Sand.ai开源MagiAttention v1.0.0。如今发布v1.1.0,适配Blackwell新架构,构建原生Group Collective原语,经系统级协同优化,在多模型训练中得到实证,展现卓越性能。
谷歌新研究:大模型“吵架”有利于提升推理质量
谷歌新研究发现高级推理模型自发进化出'思想社会',研究人员用LLM - as - judge方法识别出多个虚拟人格。还找到控制现象的'开关',实验表明教AI'吵架'更有效,其'社交技能'通用,给开发者带来新启示。
我写 nano banana pro 提示词时的原则和策略
作者分享写 nano banana pro 提示词的原则与策略,原则是做成模板、结合模型能力;策略是先跑通原型再抽象成模板;不过度精简提示词,还介绍用 GPT-5.1 等工具辅助。
模型「漂移」新范式,何恺明新作让生成模型无须迭代推理
训练生成模型复杂,传统扩散模型训练费时费力。何恺明团队提出「漂移模型」新范式,不依赖微分方程,支持一步推理,实验验证其在多领域性能佳,有望解决生成式AI质量与效率权衡问题。
新晋诺得主警告:别做梦了,AI难有「经济奇点」!
新晋诺奖得主Philippe Aghion早在2017年就剖析AI对就业与增长的影响,强调它并非奇点催化剂,而是受「鲍莫尔成本病」制约的工具。他认为AI是自动化进程的最新形态,其对经济增长的促进作用或受限。
别再用提示词去 AI 味了,方向就是错的
当下“去AI味”需求大,但用提示词去AI味是错的。原因有产出内容同质化、提示词一次性、未告知AI具体风格。作者提出写作风格Skill方案,介绍了制作步骤、模板及与其他技能的组合。
用大模型检测工业品异常,复旦腾讯优图新算法入选CVPR 2025
AI模型用于工业异常检测获新SOTA,相关论文中稿CVPR 2025。复旦大学、腾讯优图实验室等机构研究人员设计基于扩散模型的少样本异常图像生成新模型DualAnoDiff,实验显示其性能更优。
Andrej Karpathy:“ChatGPT套壳”的说法大错特错,提示词工程已过气
Andrej Karpathy力挺用“上下文工程”取代“提示词工程”,指出“提示词”过于简单,“上下文工程”更能揭示构建强大AI应用的本质。他强调“上下文工程”仅是构建大模型应用的一环,“ChatGPT套壳”说法大错特错。