因果中介分析」共找到 1136 篇相关文章

算法论文8

速度提升,能力却暴跌?扩散模型做智能体的残酷真相

南洋理工大学陶大程教授团队联合发布评测报告,揭示扩散语言模型在智能体能力上有系统性缺陷,落后自回归模型。还分析其失败原因,提出评测框架,明确能力边界并给出研究建议。

机器之心
推荐文章8

“每给 Claude Code 提一个请求,我就点上一根烟,放松下”

OpenFGA 核心维护者 Siddhant Khare 写博客吐槽使用 AI 编程的‘疲惫感’,指出 AI 带来职业疲惫却被行业回避,还分析了原因,如任务量膨胀、角色转变等,并给出应对建议,引发工程师共鸣。

InfoQ
推荐文章8

Dario Amodei 万字长文:我们已经没有时间可以浪费了,直面并克服强大AI带来的风险

Dario Amodei万字长文指出,最早2027年或现超诺奖得主AI,人类面临安全威胁。他定义了“强大AI”,分析自主性、滥用、经济颠覆等风险,给出多方面防御措施,强调人类要直面问题。

AI寒武纪
开源动态7

R1一周年,DeepSeek Model 1悄然现身

2025年1月20日,DeepSeek发布DeepSeek - R1开启新开源LLM时代,其在Hugging Face获赞最多。一年后,DeepSeek新模型Model1在GitHub现身,经Gemini分析或为DeepSeek - V4,还给出相关技术细节。

机器之心
算法论文8

为什么自监督永远学不到语义?

《Visual Language Hypothesis》论文用纤维丛理论审视视觉表征学习,指出只做连续变换难触达语义。分析现有无监督学习不足,提出“Expand - and - Snap”机制,还通过实验验证,提供审视AI架构新视角。

深度学习自然语言处理
新闻资讯8

AI 会取代你的工作吗?Anthropic 用 200 万对话告诉你答案

Anthropic发布Economic Index第四期报告,分析200万次Claude对话,提出“经济原语”框架。发现AI对高学历任务加速效果更好但成功率低,还揭示Claude.ai与API差异,引入“有效AI覆盖率”等。

宝玉AI
算法论文8

最火、最全的Agent记忆综述,NUS、人大、复旦、北大等联合出品

多所顶级学术机构联合发布百页综述《Memory in the Age of AI Agents: A Survey》,为‘Agent Memory’梳理技术路径。提出三角框架,辨析与其他概念差异,还探讨记忆形式、功能、运转机制,展望未来发展方向。

机器之心
新闻资讯7

Skills vs MCP,谁才是「大模型的 HTTP 时刻」?

近期,Anthropic新推Claude Skills获好评,而MCP协议一周年却很寂静。文章探讨MCP定位、适用边界及潜在价值,分析其与Claude Skills的关系,指出MCP生态现状及适用业务场景。

机器之心
新闻资讯7

28岁印度裔创始人忽悠谷歌24亿!劈柴哥力推的王牌IDE,底裤被扒了个精光:“套壳”Windsurf,连Bug一起!

Google发布号称‘下一代agentic开发平台’的Antigravity IDE,开发者上手体验不佳。深入分析发现它像是Windsurf专有分支,界面、功能高度相似。其创始人称它是全新理念平台,但产品问题多,安全性存风险。

AI前线
算法论文8

模型汤新做法!Meta|提出“类别专家汤”:SoCE,大幅提升模型性能,刷新SoTA!

大语言模型领域,提升性能常需高算力、大量数据和长时间训练。Meta提出新型模型汤技术SoCE,通过分析类别相关性操纵模型权重,在BFCL上刷新SOTA记录,为开源社区指明低成本进化之路。

AINLPer