模型不可知」共找到 8424 篇相关文章

产品应用7

重磅!谷歌开放世界模型Genie 3试用:AI实时生成可玩世界,人人都能创造“我的世界”

谷歌开放世界模型Genie 3实验性研究原型Project Genie试用,美国18岁以上Google AI Ultra订阅用户可体验,能创建、探索和重混互动世界,过Genie 3是早期研究模型,有待改进之处。

AI寒武纪
新闻资讯7

陶哲轩回应OpenAI宣称内部实验模型获得IMO金牌:予置评「测试方法公开就是“作弊”?」

OpenAI宣称内部实验模型获IMO2025金牌,陶哲轩呼吁对AI竞赛表现保持审慎。他强调评估AI能只看结果,测试方法很重要,对未公开测试方法的自我报告成绩予置评。

AI寒武纪
算法论文8

最强多模态模型也拿到30分?DeepImageSearch定义相册搜索新范式,开启个人视觉记忆的深度搜索时代

人大窦志成教授团队联合OPPO研究院提出DeepImageSearch图像检索新范式,将其从“逐张语义匹配”推向“语料库级上下文推理”。团队构建评测基准DISBench,用ImageSeeker框架评测主流模型,结果显示最强模型单次完美解决查询比例超三成。

机器之心
算法论文8

模型能“原地”改参数了!字节Seed&北大新论文:测试时推理无需加层重训练

字节Seed和北大研究团队提出In - Place TTT方案,让大模型能“原地改参数”。它复用Transformer的MLP模块,解决现有TTT架构兼容、计算效率低和优化目标匹配问题,实验证明可提升模型长文本任务表现。

量子位
产品应用7

高考数学全卷重赛!一道题难倒所有大模型,新选手Gemini夺冠,豆包DeepSeek并列第二

因网友质疑上次测评严谨,此次用六款大模型挑战含解答题的全套高考数学题。结果Gemini 2.5 Pro夺冠,Doubao和DeepSeek R1并列第二。解答题是失分重灾区,图像题难倒多模态大模型

机器之心
新闻资讯7

Claude 急了!模型降智,官方长文用 bug 搪塞?开发者怒怼“太晚了”:承认达标为何退钱?

8月至9月,Claude模型质量下降,Anthropic将问题归咎于三项基础设施漏洞。开发者满,质疑官方用bug搪塞,要求退款。官方虽剖析问题并提出改进方案,但很多用户已再买账,Claude用户流失问题持续数月。

InfoQ
新闻资讯7

Claude 急了!模型降智,官方长文用 bug 搪塞?开发者怒怼“太晚了”:承认达标为何退钱?

8 - 9 月初Claude模型质量下降,Anthropic发文解释是因三项基础设施漏洞。介绍了三个bug及处理办法,也分析检测难的原因并给出改进方案,但很多用户已再买账,Claude用户流失问题持续。

AI前线
算法论文8

揭开大模型“伪遗忘”,港理工等团队:结构变就是没忘

近年来大语言模型隐私风险受关注,机器遗忘技术应运而生。港理工等团队构建表示空间诊断工具,区分‘可逆性遗忘’与‘可逆遗忘’,揭示遗忘现象背后表示结构变化规律,还做了相关实验并得出核心结论。

量子位
推荐文章7

2025 年中丨大模型市场分析报告

这是《2025年中丨大模型市场分析报告》。指出基础大模型塑造计算未来,企业重心转向推理。Anthropic超OpenAI成市场头号玩家,开源模型采用趋缓,企业换模型重性能,AI支出从训练转向推理。

特工宇宙
新闻资讯7

10人创业团干翻行业“潜规则”!全员必须会AI、让跑大模型全程“裸奔”,谷歌老兵烧钱创业

在AI创业浪潮中,谷歌老兵Bryan Zhou带领10人团队创立AnyInt平台。该平台定位AI Infra中间件,一个API对接所有模型,提倡“去中心化”,让用户付费,还在工程、安全等多方面优化,吸引开发者付费。

InfoQ