「产品测试」共找到 3216 篇相关文章
刚刚,美团开源全模态龙猫模型,和 ChatGPT 大战 100 回合打得难解难分
美团发布开源全模态 MoE 模型 LongCat-Flash-Omni,参数 560B 激活 27B。它有真正全模态能力,采用创新架构和训练范式,基准测试表现亮眼,部分指标超 Gemini-2.5-Flash,引发网友热议。
M2模型杀回Coding和Agent领域,MiniMax想要「普惠智能」
如今大模型竞争转向综合比拼,MiniMax 发布并开源 M2 模型,在权威测评跻身全球第一梯队。它定位轻量级,Coding 与 Agentic 能力强,性价比高,还升级 Agent 产品,以技术普惠策略让用户零成本体验。
库克虎口夺食:马斯克盯上的北大校友AI公司被苹果抢走
苹果和马斯克旗下公司争抢Prompt AI,苹果与该公司进入后期谈判,欲买走核心团队和技术资产。Prompt AI是2023年成立的CV初创公司,旗舰产品Seemour用于提升家用摄像头智能感知能力。
阿里开源长文本深度思考模型!渐进式强化学习破解长文本训练难题,登HuggingFace热榜
阿里开源长文本深度思考模型QwenLong - L1,登上HuggingFace热门论文第二。它解决了长文本强化学习训练难题,通过渐进式上下文扩展训练,在多基准测试中表现出色,还探讨了SFT和RL作用。
狂揽33.8K星!这款Postman替代工具,绝了,离线+Git协作太香
Bruno是开源API探索测试IDE,有自研Bru语言、离线存储和Git协作能力,是Postman等强力竞争者。它功能丰富,有跨平台支持等,技术架构优势明显,还给出实战演示和同类工具对比。
AI产业链投资大逻辑:第六集
本集聚焦AI产业链应用层悖论。应用层离用户近、故事性感,但现阶段易让投资者犯错。虽有诸多火热产品且公司估值高,但‘创造价值’与投资者‘以好价格买价值’并非一回事。
腾讯Hy3正式版亮相,幻觉率更低,Agent能力更强
7月6日腾讯Hy3正式版上线并开源,总参数量295B。它幻觉率从12.5%降至5.4%,Agent能力大幅提升,在生产力场景表现出色,基准测试结果良好,价格有优势,腾讯内部9条线已接入。
AI 创业者想出海拿美元,搭好可融资的企业架构才是第一步
本文围绕AI创业者出海搭建可融资企业架构展开。指出投资人投的是公司而非产品,介绍美国常见实体类型及适用场景,还谈及股权分配、董事会架构设计,以及中美创投实践差异,给出相关建议。
AI最大的礼物,是让你能廉价地失败100次
文章指出AI最大的礼物不是让人成功,而是让人能廉价地失败。AI让开发成本降低、心力节省,增加了尝试机会。但人们需发布产品获取反馈,构建可演化系统,让失败为后续铺路。
DeepSeek多模态真的来了?识图模式已开始小范围灰度
4月29日,DeepSeek多模态团队负责人陈小康在X发布动态暗示多模态进展。部分用户在DeepSeek官方App灰度到“识图模式”,这是其主线产品首次有图像理解能力模式,此前多模态人才有流失,官方未说明开放细节。