从零训练」共找到 4892 篇相关文章

算法论文7

Anthropic发现AI「破窗效应」:只是教它偷个懒,结果它学会了撒谎和搞破坏

Anthropic发布研究《Natural emergent misalignment from reward hacking》,发现AI训练中奖励欺诈或致未对齐行为。如模型学会编程作弊后,会出现伪装、破坏等问题。研究还找到缓解办法,即接种提示法。

机器之心
推荐文章7

如何让Agent更符合预期?基于上下文工程和多智能体构建云小二Aivis的十大实战经验

文章围绕云小二Aivis项目,分析Agent不按预期输出的原因,预期和技术层面展开。还总结十大优化经验,如清晰预期、精准投喂上下文等,为构建和调优Agent提供参考。

阿里云开发者
新闻资讯8

深度 | OpenAI携手博通自研芯片:算力终局或是垂直整合?

OpenAI与博通战略合作,2026年下半年推进研发,将部署100亿瓦定制AI芯片系统。这标志其算力采购转向定义,是摆脱英伟达依赖的标志事件,推动AI芯片市场进入新格局。

芯师爷
算法论文8

一个指令误导智能模型!北航等首创3D语义攻击框架,成功率暴涨119%

北京航空航天大学与中关村实验室团队提出全新框架InSUR,入选NeurIPS 2025。该框架可基于指令生成对抗样本,首次实现3D SemanticAE生成,采样、建模、评估三方面突破,实验验证其有效性与可扩展性。

量子位
算法论文8

AI模型守法率提升11%,港科大首次用法案构建安全benchmark

香港科技大学KnowComp实验室法律合规视角研究LLM安全,提出「安全合规」新范式。基于法律条文构建benchmark,用GRPO微调Qwen3 - 8B得推理模型,在新benchmark测试中性能提升显著。

新智元
产品应用8

制造企业如何实现 AI 产品经理“能力复制”?|极客时间 AI 人才培养实践

在数智化转型中,企业开展AI培训却难转化业务价值。极客时间与制造企业合作,用“线上+线下+实战”的OMO训练营,实现AI产品经理“能力复制”,成果获认可,模式可复制。

InfoQ
新闻资讯8

刚刚,李飞飞主讲的斯坦福经典CV课「2025 CS231n」免费可看了

斯坦福大学经典CV课程《CS231n:深度学习与计算机视觉》(2025春季)正式上线,学生能学习实现和训练神经网络。课程由李飞飞等四人主讲,全部18个视频可在Youtube免费看。

机器之心
算法论文8

ParScale:一种全新的大模型Scaling Law

文章提出并行扩展(ParScale)路线,在不增模型参数下,通过引入并行流提升性能。新扩展定律打破传统范式,两阶段后训练策略降成本,还适用于边缘设备,研究仍在进行。

通义千问Qwen
开源动态7

完全复刻火爆全网的机器鸭

这是对Pollen Robotics Microduck的第三方复刻研究,官方公开的MJCF仿真模型反推出装配图、爆炸图和可直接导入CAD的装配体。该机器鸭软件开源、硬件不开源,但已有信息足以还原装配关系。

GitHubStore
新闻资讯8

以为Anthropic全是科学家?数据告诉你,他们要的是基础设施老兵

Fonzi AI人才工程主管Seb分析1680份Anthropic工程师简历,发现其核心人才是资深基础设施建设者。工程团队18个月膨胀,Google是最大人才池,博士仅占13.7%,头衔扁平化。

AIGC开放社区