AI模型测试」共找到 13681 篇相关文章

产品应用8

预算有限、技术空白:最刁钻的AI用户,是中小企业老板

2026年大模型在中小企业办公环境中应用不佳,工具与场景脱节。华为云推出专为中小企业的Flexus AI智能体平台,它依托自研模型,在多场景准确率领先,已在多行业验证效果,还能辅助内容创作。

InfoQ
算法论文8

LeCun有了新证据!大模型思考与人类思考存在本质差别

Yann LeCun参与的研究用信息论揭示大语言模型与人类在‘理解世界’上的本质差异。研究引入新量化框架,分析主流大模型,发现AI与人类在‘理解’上有三大核心差异,对当前AI发展趋势提出挑战。

AI工程化
新闻资讯8

DeepMind一篇论文终结十年之争!GPT-5推理靠世界模型

GPT-5上线后推理能力惊人。最新研究揭示通用智能体聪明的原因是长出“世界模型”,终结了学界十年关于AI靠模仿还是思考的争论,实验也验证了世界模型对智能体的必要性。

新智元
开源动态8

模型共享 GPU 内存,Berkeley 开源新工具

GPU内存利用率低是大模型部署痛点,伯克利Sky Computing Lab团队开源kvcached工具,通过虚拟化技术让多模型共享显存。它引入虚拟内存概念,按需分配,测试显示能提升效率,安装简单、兼容性好。

AI工程化
新闻资讯7

全国首部AI模型私有化部署标准,公开征集起草单位和个人!

由中国电子商会归口,智合标准中心组织起草的《人工智能大模型私有化部署技术实施与评价指南》团体标准立项,正征集起草单位和个人。该标准可解决企业部署难题,由多元主体联合起草,参与有重要价值。

PaperAgent
新闻资讯7

硅谷今夜学中文!Cursor被曝「套壳」国产,AI顶级人才全是华人

新智元报道,硅谷AI圈现神奇现象,不会中文难进核心团队。海外模型频“偷师”国内开源模型,如Cursor的Composer思考时说中文,Windsurf用GLM-4.6微调。国内开源模型量大管饱、性能好还便宜,能力稳居第一梯队。

新智元
开源动态8

AI原生数据库的思考

文章围绕AI原生数据库展开,分析企业应用大模型的问题,指出AI场景驱动数据库新工作负载。探讨AI数据库变与不变、实现路径,介绍原生混合搜索、现代数据架构、数模融合等,还提及seekdb的发布、定位、优势与不足。

InfoQ
开源动态8

国产模型新盛况!王座易主:Kimi K2 Thinking开源超闭源

月之暗面开源 Kimi K2 Thinking 模型,多方面性能超 GPT - 5 等闭源模型。它擅长多轮调用工具和持续思考,在多项基准测试达 SOTA 水平,成本低且授权宽松,引发全网讨论。

机器之心
新闻资讯7

AI 硬件新物种:七位从业者对消费级 AI 硬件的答案

2026 年 CES 落幕,释放中国 AI 硬件集体出海信号。蚂蚁集团等主办的活动上,7 位从业者分享消费级 AI 硬件产品,涵盖养成宠物、智能戒指等。他们认为 AI 硬件竞争焦点正从模型能力转向场景理解。

特工宇宙
新闻资讯8

地球级AI智能体爆诞!谷歌地球开外挂,一夜为20亿人洪水预警

谷歌结合世界建模经验与Gemini推理能力,升级Earth AI。它是地理空间AI模型和数据集,可自动连接不同地球AI模型。谷歌还推出新成果,如新一代影像与人口基础模型、空间推理智能体,可用于灾害预警等。

新智元