「溯因推理」共找到 3199 篇相关文章
AI写CUDA算子准确率92%,到国产芯片只剩4%?上交方法直线拉升,DeepSeek也适用
GPT-5.2写CUDA算子正确率92%,给华为Ascend NPU写算子仅4%,因公开数据少等致‘新硬件冷启动’难。上海交大团队EvoKernel不训新模型、不标新数据,将GPT-5.2正确率从4%拉到83%,还拓展到DeepSeek架构算子。
Soul APP 开源首个 14B 实时数字人!0.87秒延迟+32fps,冲进 I2V 趋势榜 TOP5!
AI圈对数字人爱恨交加,因其存在太假、太慢、太僵硬等问题。Soul App旗下AI团队开源实时数字人生成模型SoulX - FlashTalk,参数量14B,有亚秒级延迟、高帧率等亮点,冲进HuggingFace I2V趋势榜TOP5。
全国首部AI智能体应用评估标准,现公开征集起草单位和个人
随着大模型热潮进入深水区,企业急需业务智能体,但因缺乏可量化评估标准,AI智能体应用面临选型、验收、优化困境。智合标准中心发起《企业级AI智能体应用效能评估规范》团体标准起草工作,现公开征集起草单位和个人。
算力稀缺时代,如何把 GPU 用“满”
在 GPU 稀缺且利用率低的背景下,本文分析其‘用不好’的原因,探讨业界共享技术方案的局限。以腾讯云 TencentOS qGPU 为例,解析内核态虚拟化及在离线混部技术,还介绍其在多行业降本增效的实践。
存储市场为何“超”了又“超”?
近日,闪迪宣布调涨NAND闪存合约价,三星等巨头财报业绩超预期。摩根士丹利预计存储行业将迎‘超级周期’。存储芯片全品类产品齐涨,终端与资本共振。本轮涨价因AI需求爆发与产能重构,未来市场前景好但有不确定性。
谷歌Nano Banana Pro上线,深度结合Gemini 3,这下生成世界了
谷歌最新图像生成模型Nano Banana Pro(Gemini 3 Pro Image)上线,结合Gemini 3 Pro强大推理与知识,在控制力、文字渲染和世界知识方面升级,能生成高分辨率、一致性强图像,还支持创意操控、多语言文本生成等,多产品将上线。
cursor 2.0实测:cursor的摆烂之作
作者实测Cursor 2.0后大失所望。它交互粗糙,多智能体虽有多个回答但选方案操作不明;因Claude涨价推出智能分发和自研Composer,后者除快无优势且需魔法;内置浏览器交互麻烦,窗口管理离谱,语音模式基本不可用。
给 Agent 接搜索功能,有哪些「坑」需要特别注意?
搜索是AI产品标配,但给AI接搜索不易,给人用和给AI用的搜索差异大。信息检索质量影响Agent推理与任务完成度。邀请小宿科技相关人员聊给Agent接入搜索能力,10月30日20点线上闭门活动可扫码报名。
央企怎么做超级智能体?对谈中电信天翼AI:自研模型为底座,自主规划是必须,能适应千行百业才行
中国电信天翼AI发布星辰超级智能体,获2025企业级AI Agent榜单央企第一。它依托自研“星辰大模型”,具备全模态、复杂推理等能力。访谈专家指出智能体可直接产出应用,落地需嵌入主业系统,电信持续迭代模型优化它。
【实测&解读】全球首个手机通用Agent——AutoGLM 2.0发布!我喝到了AI为我点的第一杯咖啡~
智谱更新的AutoGLM 2.0是全球首个手机通用Agent,适配苹果和安卓手机,无需交出手机使用权。它配备云手机和云电脑,由GLM - 4.5和GLM - 4.5V驱动,能完成点咖啡等多场景任务,因风险控制付款需人确认。