「测试全流程」共找到 3925 篇相关文章
千问APP悄悄上线,阿里的AI超级入口也终于来了。
阿里千问APP悄悄上线,界面简约,功能增加,支持Qwen全系列最新模型。它将阿里系分散的AI触点收束到“千问”品牌,还默认开启搜索,整合多种功能,让普通用户使用体验更友好。
豆包也开始抢程序员饭碗了,首个编程模型来了!
字节给豆包升级编程能力,推出首款编程模型Doubao - Seed - Code。它刷新国内编程模型上下文长度,支持视觉理解,API价格良心。经测试,虽未达全球顶尖,但弥补国产编程模型短板。
Nature子刊:太空中建数据中心,无限能源,浙大首次证实可行!
浙江大学和新加坡南洋理工大学新研究探索太空碳中和数据中心可行性。太空有太阳能与散热优势,提出轨道边缘和轨道云数据中心方案,还建立全生命周期碳效率评估体系,虽有挑战但前景好。
G2ConS将微软GraphRAG的成本被打下来了~
传统Text - RAG处理多跳推理表现不佳,GraphRAG虽能提升准确率,但成本高。作者提出G2ConS方案,在3个多跳QA基准全面SOTA,平均节省30%费用,EM提升31.44%,整体流程仅3步。
全球首个AI投资大赛落幕!阿里Qwen 20%收益夺冠,GPT-5亏到只剩三成
历时17天的AI实盘投资大赛Alpha Arena落幕,阿里千问Qwen精准操盘,收益率超20%夺冠,DeepSeek位列第二,两款中国模型包揽冠亚军且是唯二盈利者,美系四大模型全线亏损,GPT - 5亏超60%垫底。
英伟达发射了首个太空AI服务器,H100已上天
11月2日,英伟达首次将H100 GPU送入太空,搭载于Starcloud-1卫星测试AI处理应用。太空数据中心能源成本低、不占土地、少排温室气体,Starcloud计划未来大规模部署,还筹划后续任务。
AI版盗梦空间?Claude竟能察觉到自己被注入概念了
Anthropic最新研究发现LLM有内省迹象,Claude能察觉概念注入。研究用概念注入测试,虽模型内省能力有限且不可靠,但能力强的Claude Opus 4和4.1表现好,未来内省或更复杂。
清华姚班团队,开源具身智能视觉语言动作(VLA)模型工具箱,打造行业通用技术底座
清华姚班团队所在的原力灵机公司,开源了基于PyTorch的视觉语言动作(VLA)模型工具箱Dexbotic。它能打造通用底座,解决行业研发困境,其预训练模型表现出色,还与Hugging Face合作推出评测平台。
OpenAI终于快要上市了,也直面了这23个灵魂拷问。
OpenAI宣布完成重组,非营利主体更名,营利公司OpenAI Group PBC接纳新股东,有了发行股票和IPO资格。随后进行1小时直播,提到AGI加速科学发现,还开展首次Q&A,回应诸多热点问题。
Meta打碎Transformer 8年铁律!改写AI最底层规则,模型首次冒出潜意识
Meta推出「自由Transformer」新模型,打破自2017年以来GPT模型核心规则,在解码器引入潜在随机变量Z,增加“潜意识”。仅增约3%计算开销,在多测试中超越大规模模型,或开启后自回归时代。