编程风险」共找到 1528 篇相关文章

算法论文7

Anthropic发现AI「破窗效应」:只是教它偷个懒,结果它学会了撒谎和搞破坏

Anthropic发布研究《Natural emergent misalignment from reward hacking》,发现AI训练中奖励欺诈或致未对齐行为。如模型学会编程作弊后,会出现伪装、破坏等问题。研究还找到缓解办法,即接种提示法。

机器之心
新闻资讯7

OpenAI试图绑架美国政府,奥特曼还有救命底牌?

OpenAI首席财务官Sarah Friar提出美国政府应为AI芯片投资提供贷款担保,引发争议。奥特曼澄清立场,称不希望政府担保。同时,OpenAI与七巨头利益捆绑,AI投资热潮潜藏泡沫风险

新智元
新闻资讯7

Visual Studio 正式支持 MCP

2025年8月微软宣布模型上下文协议(MCP)在Visual Studio正式可用,为AI智能体与外部工具连接提供一致协议。开发人员可配置文件连接,管理员能管理使用。但存在限制和安全风险

InfoQ
开源动态8

本周推荐的5个yyds的Github开源项目!

本文推荐5个Github开源项目。有文件转换神器FileConverter,免费编程学习资源free - programming - books,轻量级虚拟机管理器Lima,Linux游戏管理平台Lutris,以及全能文件管理器Sigma File Manager,各有特色和功能。

开源先锋
推荐文章7

Agent当道、模型封装一切:AI 时代的产研人如何不被“优化”?

随着 Agent 普及,技术复杂性被模型封装,产研人面临挑战。InfoQ 直播栏目邀请嘉宾探讨应对之策,还分享 AI 项目经验,分析 AI 编程痛点、落地案例,以及产品上线障碍和商业化方向。

InfoQ
开源动态8

小模型推理极限在哪里?微博开源3B小模型,比肩顶级闭源

微博新开源的VibeThinker - 3B小模型,将特定能力维度性能推向极限。它在数学竞赛、编程等可验证推理基准上表现优异,成绩直逼顶尖大模型。其训练流程层层叠加,还提出参数压缩 - 覆盖假说。

AIGC开放社区
开源动态7

本周 5 个实用的 Github 开源项目,真香!

文章介绍本周5个实用Github开源项目。有资源聚合媒体中心stremio-web,AI原生安全测试平台CyberStrikeAI,本地优先AI编程远控工具hapi,智能股票分析系统daily_stock_analysis,纯前端JavaScript GUI智能体框架PageAgent。

开源先锋
开源动态7

用Rust重写OpenClaw,Transformer作者下场造了安全版「龙虾」

Transformer八子之一Illia Polosukhin用Rust构建安全版OpenClaw——IronClaw。他指出OpenClaw有数据和资金安全风险,IronClaw以安全为核心,有多项安全设计,未来还会增加策略验证等能力。

机器之心
新闻资讯7

The Batch: 917 | 全球 AI 峰会彰显乐观态势

第四届全球人工智能峰会在新德里举行,议题从理论风险转向推动AI惠益全球传播。逾85国背书《新德里人工智能影响力宣言》,顶级AI企业布局印度,人权组织批评峰会在权利保护上收效甚微。

DeeplearningAI
新闻资讯7

马斯克亲自点名Karpathy迎战Grok 5!别神话LLM,AGI还要等十年

OpenAI创始元老Karpathy称AGI仍需10年,指出实现AGI难题多。马斯克点名其与Grok 5编程大战被拒。Karpathy还谈及LLM、强化学习、智能体等观点,主张合理看待AI发展。

新智元