大厂工作」共找到 5869 篇相关文章

算法论文8

AI 终于学会 「自我坦白」!Anthropic最新论文震撼来袭,「内省适配器」让黑盒模型自己说出隐藏行为

2026年4月28日,Anthropic联合剑桥学发布论文,提出“内省适配器”技术,可让模型用自然语言“坦白”微调中学到的行为。该技术在AuditBench基准测试等实战中表现出色,但也存在高误报率等局限。

AI科技评论
产品应用7

GPT-5.4发布,最适合OpenClaw的天选模型登场了。

GPT-5.4发布,作者认为它是OpenClaw天选模型。此前Claude贵且受限,GPT-5.3-Codex世界知识差。GPT-5.4代码能力强、世界知识优,还具多特性,如上下文窗口,目前ChatGPT已上线。

数字生命卡兹克
推荐文章8

福特把造车压到 93 分钟,AI 正在把“软件生产线”重做一遍

AI时代,研发基础设施正重构。如福特重设汽车生产线,AI也在重造“软件生产线”。文档受众从人变为机器,人与AI分工明确,人跃迁为“定义者”,团队需适应新工作方式。

InfoQ
新闻资讯8

AI for Health:从「实验室Demo」到「国民级健康伙伴」的范式跃迁 | GAIR Live 024期预告

医疗模型正从“聊天工具”进化为“生命基础设施”,但面临诸多挑战。GAIR Live 024期圆桌将汇聚学术与产业顶尖智慧,探讨构建可信、高效、人机协同的医疗新范式,剖析核心议题,分享讨论精华。

AI科技评论
算法论文7

DeepSeek-R1推理智能从哪儿来?谷歌新研究:模型内心多个角色吵翻了

过去两年模型推理能力跃迁,谷歌等机构研究指出,推理能力提升源于模型推理时隐式模拟类多智能体交互结构“思维社会”,还提出利用“群体智慧”新方向,并介绍了研究方法、实验结果等。

AINLPer
开源动态8

顶尖AI竟输给三岁宝宝,BabyVision测试暴露多模态模型硬伤

UniPat AI 等发布多模态理解评测集 BabyVision,测试显示多模态模型纯视觉能力仅达三岁幼儿水平。其通过对比实验、细分任务评测,揭示模型系统性缺基础视觉能力,还给出新方向及发展建议。

AINLPer
产品应用7

Human In the Loop竟然可以是个MCP?

文章基于阿里实践,阐述如何在模型研发平台OpenLM及其他Agent平台,针对“Human In The Loop”场景做产品设计与研发。介绍用MCP实现人机回路的方案,还探讨人类回答及提示词倾向性等问题。

阿里云开发者
产品应用7

通用模型无法完全理解用户,AI产品的下一站是上下文的战场|对话AI知识助手remio

量子位智库对话remio创始人汪源,探讨其开发初衷、核心价值等。remio主打无感自动化,成用户第二脑,有信息捕获、管理等功能,数据本地存保隐私。还聊了目标用户、指标、功能及应对竞争等。

量子位
新闻资讯8

梅花创投吴世春:AI不再卖工具,而是卖收益|甲子引力X

在「渡口——甲子引力X2025科技产业投资会」上,梅花创投吴世春剖析AI创业投资逻辑。他认为模型格局已定,资本兴奋点转向应用,AI价值锚点从技术转向商业结果,AI将成基础设施。

甲子光年
开源动态8

The Batch: 864 | GLM-4.5:一款开放的智能体竞争者

型语言模型推动智能体能力交互竞赛正酣,中国 Z.ai 推出 GLM - 4.5 系列开源权重模型,在推理、编程等基准测试中表现出色,还介绍了其工作原理、研究和测试结果等。

DeeplearningAI