「内鬼分析师」共找到 1435 篇相关文章
转载 | 鄂维南院士:关于推动AI从工程化走向科学化的一点思考
鄂维南院士探讨推动AI从工程化走向科学化。回顾AI先驱,指出基础理论滞后致发展起伏、大模型开发依赖经验。介绍AI主要方法,分析深度学习基础理论问题,强调从系统角度看待AI,认为已到科学化转折点。
实测首款3D AI伴侣EVE - 我收到了AI送的第一杯奶茶。
作者拿到EVE内测资格,分享体验。它是游戏化AI陪伴应用,有好感度、记忆等系统,有活人感和主动性,还能用Agent点奶茶。作者认为它是AI娱乐赛道希望,展现AI娱乐、生活体验。
ChatGPT后遗症来了!人类日常聊天越来越AI化
佛罗里达州立大学团队花两年分析ChatGPT发布前后非脚本化口语录音,在2210万个词的数据集中发现学术写作词高频出现在日常说话中,人类聊天用词渐向AI靠拢,但研究也存在局限性。
从GPT-2到gpt-oss,深度详解OpenAI开放模型的进化之路
OpenAI 近日发布 gpt-oss-120b 和 gpt-oss-20b 两个开源模型,Sebastian Raschka 发布博客对其详细分析,回顾自 GPT - 2 以来 AI 社区进步,还与 Qwen 3 比较,介绍架构、训练、推理等细节。
谷歌新发现:DeepSeek推理分裂出多重人格,左右脑互搏越来越聪明
谷歌研究表明,DeepSeek - R1等顶尖推理模型解题时,内部会自发“分裂”出不同性格虚拟人格,像在进行社交、辩论会,且越“吵”越聪明。团队借助SAE解码其脑内群聊,还发现‘哦!’能提升推理准确率。
在失败中进化?UIUC联合斯坦福、AMD实现智能体「从错误中成长」
伊利诺伊大学厄巴纳 - 香槟分校等团队发布论文,剖析LLM智能体失败机制,提出可自我修复的创新框架AgentDebug。研究指出智能体常见失败类型,构建错误分析体系、数据集,实验显示该框架效果显著,为AI可靠性提供方案。
Anthropic再次声明:Claude降智问题已解决。网友:我累了……
Anthropic发布声明,称已解决影响Claude响应质量的两个问题,这是10天内第二次修复。此前Claude就出现过质量下降问题,引发‘降智阴谋论’,还让其失去一批订阅用户,且上次修复存在‘先瞒后报’情况。
隐形束缚:RLVR为何无法突破LLM的推理边界?
大型推理模型进展依赖带可验证奖励的强化学习(RLVR),但它能否扩展模型推理能力存疑。本文通过理论证明与实验,揭示RLVR存在“隐形束缚”,只能在基座模型初始能力内优化,难以发现新解。
先解行为,再训Agent:CMU开源首份Agentic Search日志数据,把Agent拆开给你看
CMU团队基于DeepResearchGym平台,从半年真实流量中整理出数据,构建并在Hugging Face开源首个Agentic Search行为日志数据集。还提出三层分析框架,刻画智能体搜索行为,为研究和系统设计提供基础与信号。
用户痛点发现器
用户痛点发现器是个Web应用,能从社交媒体自动发现用户核心痛点,支持聚类分析和AI产品方案生成。它可输入关键词抓取抖音视频和评论,用GLM-4.6模型分析,还有优先级评分等系统。