「元认知重用」共找到 970 篇相关文章
撕开Claude Code真相:让它好用的98.4%,是工程不是AI
X用户推文曝光Claude Code项目模板,实则是公开范式。研究显示Claude Code 98.4%是工程基建。OpenAI等团队已将AI编程跑成生产线,普通开发者也能搭建入门版基建。
AI能自己打红警了!经济拉满零交战惨遭打脸,玩家笑疯
Hugging Face推出OpenRA-RL,将《红色警戒》改造成大模型的Agent训练场,50个MCP游戏工具全量暴露,25Hz实时状态流推送,打通三条训练路线,原生接入OpenEnv生态。实战中,Agent经济满分但战斗零分。
糟糕,Claude Opus 4.7源代码级提示词曝光!底层设计全被看光
Claude Opus 4.7如期而至,性能全方位提升,编程暴打Gemini 3 Pro、GPT - 5.1。Claude Code之父分享最佳实践,还曝光系统级提示词,揭示其进化逻辑,此外还提及Mythos的一些危险操作。
跨OS GUI智能体基础设施白皮书——重新定义人机交互自动化|甲子光年智库
《跨OS GUI智能体基础设施白皮书》由庭宇科技和铸基计划联合发布,剖析GUI Agent市场格局、技术路径与落地场景。指出其引发人机交互革命,能突破API局限,还介绍产品形态、发展挑战等。
中国AI算力,开启「共同富裕」之路!
中国AI产业存在算力差距,头部大厂算力过剩,中小企业却受困。中科曙光scaleX40超节点发布,降低高端算力获取门槛,重塑AI创新主体、产业落地路径及国产算力发展方向,推动算力平权。
MMLU已死?「人类最后考试」登Nature:全球AI模型集体不及格!
AI发展迅猛,现有基准测试难以跟上其步伐。近1000名研究人员组成的全球联盟创建「人类最后的考试」(HLE),涵盖多领域难题,目前最强AI准确率不足50%,凸显AI与人类专家的差距。
刚刚,OpenClaw登顶GitHub软件星标历史第一!已超越Linux
仅两月,本地AI框架OpenClaw击败Linux,登顶GitHub星标第一。它是开源本地运行的AI Agent框架,能接入通讯工具,虽引发安全危机和限制,却热度不减,反映开源社区趋势变化。
一天两枚“代码核弹”:OpenAI 祭出首个“主打实时协作”的 Codex 模型,谷歌放出 Gemini Deep Think,码力冲到世界前8
OpenAI 发布 GPT - 5.3 - Codex - Spark 研究预览版,专为实时编码设计,降低交互延迟。谷歌更新 Gemini 3 Deep Think,面向科研与工程难题,在多领域测试表现出色,二者引发网友热议。
别跟风买Mac Mini了!国产算力跑OpenClaw,只需5分钟
最近,Clawdbot爆火,OpenClaw仓库Stars涨至13万,但运行它消耗大,很多人用Ollama拉取本地模型。不过,Ollama只支持部分生态,国产芯片用户面临挑战。2026年2月2日开源的玄武CLI可解此难题。
DeepSeek-OCR是「长文本理解」未来方向?中科院新基准VTCBench给出答案
DeepSeek - OCR的VTC技术可实现高压缩率,降低长文本处理成本。但视觉语言模型能否理解压缩信息存疑,中科院等推出VTCBench评估,测试模型认知极限,还推出VTCBench - Wild检测鲁棒性。