「模型可解释性」共找到 10003 篇相关文章
软件 3.0 时代来临
OpenAI 联合创始人 Karpathy 在 AI Ascent 2026 大会提出软件正经历第三次范式转移。从 Software 1.0 到 3.0,人类参与编程方式不断变化,3.0 用自然语言编程,中间层应用被模型原生能力吞噬。
阶跃Step 5 Preview没赢GPT,但反而更好用了
本文作者实测600B参数量的阶跃Step 5 Preview大模型,从写码、幻觉控制、写作三个维度,对比GPT及其他国产头部模型,分享无滤镜真实体验,给出选型参考。
谷歌全新Gemini Omni首曝,视频版「香蕉」来了!教授黑板推公式全对
谷歌原生视频模型Gemini Omni意外曝光,其生成视频的连贯性、一致性惊艳,还能实现实时编辑。此前OpenAI的Sora App停服,谷歌I/O 2026将开幕,多款Gemini模型或亮相。
“烧掉94亿个OpenAI Token后,这些经验帮我们省了43%的成本!”
作者以月耗94亿OpenAI Token实战经历,分享优化成本经验,如选对模型、用提示词缓存、设账单预警等,降低成本43%,不过网友对此有不同看法。
0%完成率!Claude、GPT、Gemini 全灭,SWE-Bench作者新作把AI圈干沉默了
SWE - Bench创建者推出新benchmark ProgramBench,测试AI从零构建软件系统能力。结果一线模型完成率0%,暴露AI擅长局部代码生成,缺全局系统规划能力,引发对其评估方式的讨论。
这个Skill可以消除文本中AI生成的痕迹,没了AI味的内容肯定会更受人喜爱。
AI创作大爆发,但其生成内容有“机械感”。介绍了可在Claude Code使用的Skill,能消除AI生成文本痕迹,还给出手动修改方法及原则,呼吁创作者用心改内容。
Skills刚火,就有零Skill的Agent来了…
Skills爆火之际,云玦科技团队提出不用Skills的零Skill Agent。它以Gemini 3 Pro为后端,在多个评测集表现出色。采用原位自进化框架,开源且成本低,或助力开源模型弯道超车。
170次搜索+50次反思:用GLM-4.7盘点2025 Agent行业趋势,结果太震撼!
作者给智谱新开源的GLM - 4.7布置调研2025年Agent赛道企业的任务,结果令人震撼。该模型进化显著,能整理详细企业信息,还能生成高审美PPT。国内有不少特色AI落地企业。
深度洞察:AI带来的产业发展趋势
文章指出AI正以极快速度改变世界,趋势已成。探讨软件业从以应用为中心到以模型为中心的变革,还将阐述从以应用为入口到以AI为入口、AI巨头发展方向及未来展望等内容。
刚刚,Claude 又杀死了所有 todo 工具
Claude 可直接操作 iOS 提醒事项,只需告知任务,它会申请权限并设定日程。作者认为从现在起,所有 todo 软件都可‘去死’,Claude 将成智能日程助理,还能查看、管理提醒。