「代码价值」共找到 2247 篇相关文章
倒反天罡!Claude「反向」操控人类,公司估值冲2万亿跃居全球第二
2026年1月17日,一段‘AI指挥人类写代码’视频刷屏,Claude Code能力引发关注,模糊人机交互界限。18日《金融时报》称红杉资本将参与Anthropic新一轮融资,其估值冲向3500亿美元,或成2万亿级AI独角兽。
17万白领岗消失!Scale AI最新研究:AI仅动用了3%实力
新智元报道,近期多家巨头裁员17万,AI成“罪魁祸首”。但Scale AI和Center for AI Safety研究指出,全球六大顶尖AI自动化率不到3%,新基准RLI评估显示其执行有经济价值项目能力有限。
避免Claude Code 降智的一小招
Claude Code近期表现变差,简单代码逻辑会搞混,调试建议也不对。作者分享小妙招,切回Opus 4.0能让其恢复智商,还介绍三种切换模型方式,并分析了其降智原因。
1899个MCP服务安全研究:7.2%存在漏洞,5.5%暗藏「工具投毒」
研究人员对1899个开源MCP服务器扫描,发现7.2%项目有漏洞、5.5%遭工具投毒。MCP虽成事实标准且发展好,但代码质量堪忧,传统安全工具难检测其风险,为生态敲响警钟。
TACO: 让 CLI Agent 在自主迭代中学会丢掉无用上下文
由多校及研究团队联合提出 TACO,这是无需训练、即插即用的终端智能体自进化观测压缩框架。它能让智能体学习压缩规则,过滤低价值输出,保留关键线索,实验显示其提升了任务成功率和 token 效率。
2050年,衰老将被攻克?合成生物学教父揭秘长寿未来!
现代合成生物学教父George Church在采访中分享对生物技术的看法,认为基因测序等技术让大突破不远。预计2050年解决老龄化问题,体细胞疗法或让人‘返老还童’,还谈及复活物种、‘镜像生命’等,强调遗传咨询价值。
红杉中国xbench全球首发,AI智能体真实战力揭榜!
红杉中国推出全新AI基准测试工具xbench及相关论文,采用双轨评估体系和长青评估机制,首期发布两个核心评估集并综合排名,还提出垂类评测方法论。它能追踪模型能力与实际场景价值,解决现有评估难题。
ACL 2026 | 腾讯混元Agents工具学习新范式
腾讯混元团队在 ACL 2026 Findings 发布的 ToolCPT 指出,Agent 用不好工具病根在预训练。它从真实代码挖工具,写说明书,融入预训练,实验显示能有效提升工具运用能力,但也有局限和成本。
Karpathy实测Opus 5:读一段《魔戒》,10美元直出中土世界!
Andrej Karpathy 用 Opus 5 结合《指环王》开篇文字,花约 10 美元让其渲染 3D 游戏。Opus 5 两小时写出 5500 行代码生成 3D 世界,虽粗糙但证明 AI 强大。不过,LLM 无法高效审查自己工作,这是弱点。
1.2万人收藏单日斩获 3.4K!刚刚冲上 GitHub Trending 榜首的“AI 红队”工具!
AI加速代码编写,但也留下更多安全坑,传统扫描工具和人工渗透测试难以应对。新晋GitHub Trending榜首工具Shannon是全球首个开源全自动AI渗透测试员,多智能体架构,功能强大,适合AI编程团队。