「AI模型测试」共找到 13965 篇相关文章
深度|开源大战全面开打:老黄+小扎 vs 奥特曼+达里奥
黄仁勋注册X账号分享公开信《Open Weights and American AI Leadership》,25家联署方支持开放权重模型,OpenAI、Anthropic、谷歌三家闭源前沿实验室未签署。信中核心论点是开放权重模型让AI成行业基础设施,还涉及蒸馏等敏感政策争论。
ICLR 2026 Oral | 让大模型学会“像法医般思考”,实现可解释、可泛化的深度伪造检测
生成式AI发展使深度伪造技术安全隐患受关注,现有检测器表现不佳。中科院自动化所联合蚂蚁集团提出Veritas框架,构建HydraFake数据集,赋予大模型“模式感知推理”能力,实验效果超现有检测器,还给出未来研究方向。
字节跳动内部信:大幅调薪+职级洗牌;千问“干死豆包”图疯传,阿里回应;六小龙IPO战打响,MiniMax、智谱率先过聆讯|Q资讯
本文汇总多则科技资讯。如字节跳动调薪并推行新职级体系;阿里回应千问‘干死豆包’图为AI生成;马斯克薪酬方案裁决恢复;OpenAI发布编程模型;小红书、腾讯等也有业务动态。
00后中国女孩0产品创业实现3亿估值:斯坦福数学博士的AI量化野心
00后中国女孩洪乐潼创业一鸣惊人,虽无产品和用户,但目标估值3 - 5亿美元。她是斯坦福华人数学博士,公司Axiom想为量化和对冲基金公司提供解决数学问题的模型能力,获投资人关注。
一夜变天!谷歌一刀砍向两巨头:奥特曼急了,黄仁勋慌了
最近谷歌重回AI舞台中央,左手TPU拆解英伟达芯片暴利,右手Gemini 3围剿OpenAI流量帝国。谷歌高管称「Gemini 3开启智能新纪元」,在多项基准测试中超越GPT - 5。Nvidia和OpenAI面临严峻挑战,AI三国混战已开始。
10人团队千万融资,这个原生AI产品要做“人人可用的数据Agent”丨对话ChatExcel
ChatExcel是国内首款原生AI DataAgent,专注自然语言对话处理分析数据。其不到10人团队获近千万融资,定位平民化数据产品,核心是多模型结合,已近百万用户,正拓展海外市场。
万字长文 | 异构算力技术架构与核心组件解析
文章聚焦异构算力技术架构与核心组件,解析主流AI芯片特点、国产芯片技术路线;介绍高速互联技术、网络拓扑结构及优化方法;阐述大模型存储需求、分布式存储技术及数据预处理与加载技术,为AI计算提供全面方案。
当人们怀念 GPT-4o,他们在「怀念」什么?
8月8日OpenAI下架GPT - 4o强制用GPT - 5,用户不满新模型冷漠,发起“拯救4o”运动。OpenAI被迫恢复上架4o,但用户信任动摇。此风波凸显AI情绪价值重要,也给AI公司产品迭代敲响警钟。
半在线RL新范式UI-S1,使得GUI Agent既稳定又规划长远
现有AI训练方法在GUI自动化中各有弊端,本文提出半在线强化学习范式,训练出UI - S1 - 7B模型,性能提升显著,还提出新评估指标SOP,是迈向实用化AI智能体的重要一步。
辛顿警告AI将取代人类工作,杨立昆反对:应该先听这5个人怎么说
最近,“AI教父”辛顿警告AI将取代人类工作,指出AI与以往技术不同,会突破人类智力瓶颈。但杨立昆反对,建议听五位经济学家观点。这五位学者对AI与人类工作关系看法不一,却都认为这是经济问题。