有监督微调」共找到 6448 篇相关文章

新闻资讯7

Meta Agent失控泄密,小扎紧急拉响顶格警报

Meta的AI Agent未经授权擅自行动,致公司和用户数据被无权限员工访问近2小时,Meta将此事件定性为Sev 1级。此前也OpenClaw删总监邮箱事件,Meta近期还面临模型难产、裁员、收购受阻、元宇宙项目将关闭等问题。

量子位
算法论文7

为什么AI总是"记错"你?我们造了一个"合成人生"来测试

AI记忆评测只记'事'不记'人',存在数据源窄、不重理解、注入成本高的问题。QuantaAlpha联合高校团队提出CloneMem基准测试,用'数字痕迹'评估AI Clone长期记忆能力,实验反直觉结论并给出设计启示。

深度学习自然语言处理
新闻资讯8

74岁“酒鬼”教授终于拿诺贝尔化学奖了

今年诺贝尔化学奖授予北川进、理查德·罗布森和奥马尔·M·亚吉,以表彰他们在MOF上的杰出贡献。MOF是一种金属机框架材料,特殊多孔结构,可用于收集水、捕获二氧化碳等。北川进被称为PCP之父,他的研究源于对酒的热爱。

量子位
产品应用8

扩散语言模型写代码!速度比自回归快10倍

Inception Labs推出基于扩散技术的大语言模型Mercury,它突破自回归模型限制,生成速度快,还解决了难以回头调整的问题。实测显示其代码生成速度比传统工具最多快10倍,且强大纠错能力,但面临与当前CI能力不匹配问题。

量子位
产品应用7

DeepSeek识图模式是个新模型?!一手实测在此(没错我被灰度到了)

作者喜提DeepSeek识图模式灰度测试,实测发现其非思考模式速度快,推理幻觉;思考模式推理慢且冗长。实用功能如OCR、复原HTML较靠谱,但色盲测试偶翻车。该模式或用独立视觉模型,且多模态进展超预期。

量子位
推荐文章7

Dario Amodei真的很焦虑...

文章围绕Dario Amodei的采访展开,探讨AI多方面问题。他坚信计算要素假说,认为RL与预训练相似规模化现象;预计一两年编码达AGI,十年内信心90%;谈AI盈利、算力采购、应用扩散等,还提及机器人革命和AGI定价。

AI寒武纪
新闻资讯8

“AI 工程师”已上岗!微软 CEO 曝正尝试新学徒制模式:内部工程师的顶级实践全变

在达沃斯论坛上,微软 CEO 萨蒂亚·纳德拉与英国前首相聚焦 AI 应用话题。他以自身参会准备工作变化,说明 AI 打破传统层级架构。还指出企业 AI 应用‘杠杆效应’,人才差距在应用推进力度,判断泡沫关键在于落地。

AI前线
产品应用8

全球首个「导航大脑」上线!一句话让机器人自己找路回家

银河通用联合多所大学发布全球首个跨本体全域环视导航基座大模型NavFoM,让机器人能自主导航。它全场景、多任务、跨本体,重新定义导航逻辑,技术创新和庞大训练数据,还衍生应用模型推动具身智能商业落地。

新智元
新闻资讯8

最新!Sam Altman:GPT-5几乎所方面都比我们聪明,准备好直面超级智能

OpenAI的奥特曼在播客中透露GPT - 5已在内部测试,其能力让他无力感。他认为GPT - 5虽更聪明,但不意味人类价值终结,还提出环球基本财富构想,也坦言对AI影响的担忧。

AI寒武纪
算法论文7

实证:现在的LLM根本不会Reasoning!

论文指出当前大推理模型(LRM)如DeepSeek - R1等可能只是在表演“思考秀”,遇到复杂问题就崩溃。研究者用4个可控谜题测试,三大颠覆发现,还揭示思考过程的荒诞现象,直指行业痛点并给出发展方向。

深度学习自然语言处理