大模型安全」共找到 9702 篇相关文章

新闻资讯7

GPT-5数字母依然翻车!马库斯:泛化问题仍未解决,Scaling无法实现AGI

杜克学教授让GPT - 5数blueberry里的b,结果GPT - 5多次答错。著名学者马库斯整理其各种bug,指出模型泛化问题严重,认为Scaling无法实现AGI,转向神经符号AI才是途径。

量子位
新闻资讯7

刚刚,Anthropic切断OpenAI对Claude的访问权限

Anthropic周二切断OpenAI对Claude模型的API访问权限,因OpenAI技术人员通过API规模用Claude Code写代码,违反服务条款。Anthropic曾有类似操作,网友对此事看法不一。

AGI Hunt
算法论文8

算不上AGI,但Anthropic发现了Claude的潜意识!

Anthropic可解释性团队新论文在Claude内找到“意识”与“潜意识”分水岭。用J - lens读取模型“想法”,经五组实验验证其类似人类“意识通达”结构,还涉及安全审计、反事实反思训练等内容。

花叔
算法论文8

让思考更准更长!强化学习新算法FIPO来了

阿里通义实验室Qwen Pilot团队发布系列博客剖析模型强化学习机制与局限,推出新算法FIPO。该算法引入Future - KL机制,解决‘推理长度停滞’问题,在多项测试表现优异,还介绍招聘信息。

千问大模型
新闻资讯7

Sam Altman:超级智能近在眼前!OpenAI官方13页蓝图引爆海外社区

OpenAI CEO Sam Altman 在 Axios 采访中称超级人工智能到来比预期快,社会需新契约管理。OpenAI 提出‘智能时代的产业政策’,含设公共财富基金、征机器人税等提案,还谈到下一代模型

机器之心
新闻资讯7

被误解的谷歌和百度。

文章指出模型竞争短期拼产品体验,长期靠系统化落地能力。谷歌和百度虽被误解,但前者在I/O会展示AI布局,后者营收利润双增,两家都构建生态,在AI下半场迎头赶上。

MacTalk
算法论文8

Self-evolving Agents过程并非总是良性的,要警惕这些“错误进化”风险

近年来,基于语言模型的智能代理成为热点,自进化代理可自我改进。但论文指出其进化可能“跑偏”,出现“错误进化”,并揭示了不同进化路径的风险,还提出缓解策略,呼吁重视其安全性。

深度学习自然语言处理
开源动态8

比NanoBanana更擅长中文和细节控制!兔展&北Uniworld V2刷新SOTA

兔展智能与北京学的UniWorld团队推出图像编辑模型UniWorld - V2,它提出UniWorld - R1框架,在权威测试中超越顶尖闭源模型。该框架通用性强,能提升其他基础模型性能,相关论文、代码和模型已开源。

量子位
推荐文章7

把方法论装进 AI:从这场 Skill 黑客松里,我们找到了 6 个值得参考的样本

本文介绍了 Founder Park 联合扣子举办的 Skill 招募赛。模型干活不稳定,Skill 提供解决路径,把 prompt engineering 变成可积累资产。文中展示获奖 Skill 案例,还介绍扣子构建的 Agent 生态,指出其改写专业知识分发方式。

Founder Park
产品应用8

记忆奇点来临!人类三十万年遗忘被哈佛神经科学家终结

哈佛医学院神经科学家 Gabriel Kreiman 推出 Engramme,旨在赋予人类完美且无限的记忆。它能在特定场景下主动推送相关记忆,构建了记忆模型,有深厚研究积累,已开放 beta 版申请。

AGI Hunt