「新推理模型」共找到 9817 篇相关文章
写在 Claude Design 发布之后:如果明天巨头做掉了你的核心功能,你该怎么办?
Anthropic 发布 Claude Design,可从提示词生成设计稿等,让 Figma 市值蒸发。这引发对 AI 应用层产品的思考,当基础模型厂商收回能力,靠能力缺口的产品将失重,应用层需从工作流、数据等找机会。
首钢园科幻“朋友圈”扩容,科幻产业联合体生态版图再升级
3月18日,2026年科幻产业联合体会员大会在首钢园举办,是联合体生态版图的一次升级。随着新企业加入,会员达71家,构建跨界协同生态。大会还进行政策解读,助力企业发展,未来将深化发展模式,打通产业生态闭环。
对话 Elys 创始人:他的 10 个产品洞察,和他想创造的下一代社交网络
极客公园与 Elys 创始人 Tristan 深度对话,分享 10 个产品洞察。他认为 context 价值大,做新 AI 产品要找好形态,记忆系统本质是推荐系统,还阐述了对 AI 社交等看法,目标是创造低熵社交网络。
首个开源实现100%可复现的稳定RL训练框架来了!2次结果完全重合
SGLang团队联合slime团队开源实现100%可复现的稳定RL训练框架。基于Qwen3 - 8B重复实验结果完美重合。SGLang在批次不变算子基础上实现确定性推理,性能有下降但有提升空间,还给出使用方法和未来规划。
Shopify分享了他们做Agent的万字踩坑经验
Shopify分享构建生产级AI助手Sidekick的万字经验。构建中遇工具拓展难题,用JIT指令解决;评估是大挑战,建立严谨体系,虽有提升但效果仍有波动,模型还会钻空子,最后强调单Agent系统也强大。
对谈 DeepSeek-Prover 核心作者辛华剑:Multi Agent 天然适合形式化数学 |Best Minds
文章是对 DeepSeek-Prover 核心作者辛华剑的访谈。他认为强化学习是 AGI 关键解法,Multi Agent 适合形式化数学。还探讨了 DeepSeek Prover 进展、数学与 AGI 关系、评测基准等,指出未来有全才模型和自主 Agent 出现。
近 300万人围观卡帕西亲测 Opus 5:两小时写完 5500 行代码, 却连自己写的游戏都玩不了
8月2日,Andrej Karpathy在X公布实验,让Claude Opus 5用Three.js将《指环王》第一章渲染成3D场景,约两小时写出5500行代码。Opus 5按传统游戏开发路线搭建场景,这改变了内容定制方式,但模型验证能力不足。
眼馋苹果刚发布的液态玻璃效果?藏师傅教你提示词一键实现
苹果 WWDC2025 发布的液态玻璃效果引关注,虽卡片中心可读性差,但预计会被广泛使用。藏师傅探索出将其融入网页生成的提示词,介绍了在不同模型上的效果及提示词内容和使用注意事项。
Scaling时代终结了,Ilya Sutskever刚刚宣布
Ilya Sutskever 在访谈中称「Scaling 时代已终结」,指出当前模型存在能力参差不齐、泛化不足的问题。他认为人类情绪类似价值函数,人类学习效率高。未来 AI 发展将进入研究时代,他还分享了 SSI 战略及对 AI 对齐等问题的看法。
黄仁勋放话:中国AI市场3年内达500亿美元!AI救了旧金山,整个世界急于与AI互动
黄仁勋最新判断,未来两到三年中国AI市场可达约500亿美元,错过是巨大损失。他还提到AI让旧金山复苏,虽会使部分人失业,但也创造新岗位。此外,英伟达财报值得期待,老黄获十年来首次加薪。