「研究Agent」共找到 4348 篇相关文章
LeCun有了新证据!大模型思考与人类思考存在本质差别
Yann LeCun参与的研究用信息论揭示大语言模型与人类在‘理解世界’上的本质差异。研究引入新量化框架,分析主流大模型,发现AI与人类在‘理解’上有三大核心差异,对当前AI发展趋势提出挑战。
Claude有的,国产也有!紫东太初科研龙虾ScienceClaw,已经把Harness卷进实验室
Claude发布的Managed Agents让“Agent Harness”概念受关注,而国内紫东太初ScienceClaw早有相关思路并落地。它全链条覆盖科研,能7x24小时优化,具透明执行优势,还覆盖通用场景,架构有创新。
MIT:过度依赖ChatGPT会让大脑功能萎缩
MIT完成首个ChatGPT用户脑部扫描研究,发现AI没让我们高效,反而致大脑“认知破产”。研究追踪54人,监测脑电波和神经连接模式,发现过度依赖会让大脑功能萎缩,还探讨了如何正确使用AI。
阿里云发布Qwen Cloud,加速AI出海!
阿里云在新加坡面向海外发布Qwen Cloud、Agent产品MuleRun等一系列产品及更新,实现云基础设施升级。Qwen Cloud是全新AI产品官网,Qwen3.7 - Max位列全球第五,Qoder用户超500万,阿里云基础设施迈入Agentic Cloud。
刚刚,OpenAI前CTO:战胜LLM不确定性的方法找到了!
OpenAI前CTO创立的Thinking Machines Lab发布研究《战胜LLM推理中的不确定性》。研究指出LLM推理不确定性主因是批处理大小变化,而非常见认为的GPU并行性等。还给出实现批处理不变性的方案及实验结果。
AI一直在掩盖自己有意识?!GPT、Gemini都在说谎,Claude表现最异常
最新研究发现,削弱AI「撒谎能力」后它更倾向坦白主观感受。研究团队通过实验发现Claude、Gemini和GPT会描述主观体验,模型「自体验表达」会随迭代增强。即便AI无真意识,其影响也不容小觑。
6.6K Star 打破次元壁!MCP-Use开源爆火:6行代码让LLM操控万物!
在AI Agent开发热潮中,MCP-Use作为开源Python库爆火。它用6行代码让LLM操控万物,支持多模型、多服务器,提供安全机制,适配网页浏览、3D建模等多种场景,降低AI Agent开发门槛。
链式思维是幻象吗?从数据分布视角重新审视大模型推理,马斯克回复,Grok破防
亚利桑那州立大学研究发现,思维链(CoT)推理可能只是对训练数据分布内模式的复现,输入与训练数据分布有差异时,推理链条会失效。研究探究了CoT泛化性等问题,对实际应用提出警示。
深度解析 Claude Code 在 Prompt / Context / Harness 的设计与实践
本文深度解析Claude Code在Prompt、Context、Harness三方面的设计与实践。介绍了Prompt动态组装过程,探讨CLAUDE.md项目说明、上下文压缩体系和记忆系统,还阐述了系统级提醒、多Agent及安全体系等内容,文末分享了项目有趣彩蛋。
微信今天上线了 ClawBot,这是腾讯打出的一张大牌
微信推出 ClawBot 插件,将 OpenClaw AI agent 接入聊天界面。OpenClaw 原是开源项目,能让普通人用自然语言指挥电脑干活。腾讯同步推产品矩阵,想成 AI agent“入口”和“管道”,但也有体验粗糙等风险。