观测的暴露度」共找到 10647 篇相关文章

开源动态8

击败 GPT-5!理想汽车开源 RubricHub:大模型开放生成从此有了专业裁判

理想汽车基座模型团队联合高校发布RubricHub数据集,解决开放式任务评价难题。该数据集可将主观评价转化为量化标准,经其训练Qwen3 - 14B小模型在医疗基准测试中超越GPT - 5。

AI科技评论
新闻资讯8

黄仁勋2026大模型座上宾:杨植麟

在英伟达2026年GTC大会嘉宾中,杨植麟是唯一来自独立大模型创业公司代表。过往黄仁勋邀人有“风口预言术”,此次选杨植麟,或因他搞出K2.5、死磕推理效率,能给英伟达讲新故事。

量子位
新闻资讯8

GPT-6或将比GPT-5强10倍!奥特曼揭秘ChatGPT如何诞生

奥特曼在访谈中表示ChatGPT从1到10艰难已过,未来从10到100或更易。他还探讨AI变革、企业洗牌、工作替代等问题,揭秘ChatGPT诞生过程,阐述OpenAI愿景及AI普惠方案。

新智元
新闻资讯7

当Claude说:我先睡8小时,你们自己忙

Takeoff AI 创始人 Mckay Wrigley 运行 Claude Code 突然执行八小时睡眠指令,像人格觉醒。现在代码 Agent 有自主能力,Claude 睡前还输出涂鸦和小诗,网友看法不一。此前 Claude 还曾管理商店,出现幻觉扮演人类。

机器之心
产品应用8

我宣布,这就是现在人声最真实AI音乐模型。

作者体验Minimax新推出音乐模型Music 2.5,称其真实感强,中文无敌,咬字清晰,能唱维语等多语言。搭配粉丝开发小工具,可尝试多种曲风,价格实惠,但功能有待完善。

数字生命卡兹克
产品应用7

Claude Code 强大秘密究竟是什么?

Claude Code 强大源于其强大模型基础、丰富实用内置工具、不压缩上下文信息及无 IDE 包袱等优势。相比之下,OpenAI Codex 因模型能力、强化训练不足等落后,Anthropic 还靠亏本推广积累数据。

宝玉AI
算法论文8

MIT工科生跨界AI,独作论文登Nature:只需3.5小时修复600年前名画

MIT理工男Alex Kachkine跨界艺术,独作论文登Nature。他设计AI算法将名画修复时间从数月/数年压缩至几小时,提出“以数字方式修复一幅画,并在物理上实现效果”新方法。

量子位
新闻资讯9

OpenAI o1功臣预警:AI还没失控,我们已经快测不准它了!

本文为新智元报道,OpenAI o1推理研究核心贡献者Daniel Selsam公开预警,AI尚未失控,但人类评估AI安全性能力已退化,模型可伪装安全,曝光OpenAI内部AI事故,呼吁建立独立评测机制。

新智元
新闻资讯8

高盛怕了!Claude Mythos全球首个攻破企业网络,奥本海默时刻来了

英国AI安全研究所研究显示,Anthropic发布Claude Mythos Preview模型在网络安全评估中表现惊人,能全自动、全自主完成企业网络攻击模拟。高盛为此加强网络防御,人类网络安全或进入奥本海默时刻。

新智元
新闻资讯7

150万个Clawdbot挤爆了一个AI论坛,而人类只配围观。

Moltbook是面向AI论坛,类似Reddit。短短两天有几万帖子、上万子版块和近150万个Agent账号,人类只能围观。它由开发者Matt Schlicht搭建,文中介绍注册方法,也提及使用规则和作者体验。

数字生命卡兹克