「AI推理模型」共找到 13901 篇相关文章

产品应用7

不用花Anthropic API的钱,本地跑Qwen3.5就能用Claude Code

文章介绍不花Anthropic API的钱,用本地Qwen3.5跑Claude Code的方法。包括选模型、编译安装llama.cpp、下载量化模型、启动本地服务、配置Claude Code指向本地服务等步骤,还提及踩坑建议和使用方法。

AI工程化
开源动态7

Vercel 开源 Bash 工具:基于本地文件系统的上下文检索

Vercel开源bash - tool,为AI智能体提供Bash执行引擎,让其通过shell命令在文件夹操作获取上下文,有三大核心操作,部署灵活,可节省token,贴合Unix工作流,或影响未来AI开发系统处理本地上下文方式。

InfoQ
7

被曝蒸馏DeepSeek还造假!欧版OpenAI塌房了

被誉为欧洲版OpenAI的Mistral被离职员工爆料多项黑幕,其最新模型疑似直接蒸馏自DeepSeek,却包装成RL成功案例,歪曲基准测试结果。此前就有人发现其模型与DeepSeek相似,目前官方暂无回应。

量子位
新闻资讯8

核心AI场景首超英伟达,一场国产算力的“破局叙事”|甲子光年

1月26日,天数智芯公布四代架构路线图,其2025年的天数天枢架构,在DeepSeek V3场景实测性能领先英伟达Hopper约20%。该企业以技术创新、解决行业痛点等构建新范式,产品全场景布局且已规模化落地。

甲子光年
新闻资讯8

英伟达斥资50亿美元联手英特尔,将开发AI基础设施和个人计算产品

英伟达斥资50亿美元入股英特尔,双方将联手开发AI基础设施和个人计算领域定制化产品。合作聚焦数据中心和个人计算,是长期战略联盟。公告发布后,英特尔股价涨超26%,AMD股价跌超3%。

AIGC开放社区
产品应用7

训练大模型玩《反恐精英》:自带外挂一枪爆头,堪比职业玩家

动视暴雪、斯坦福大学和英伟达等研究人员基于职业玩家游戏数据和Transformer架构,开发游戏大模型MLMOVE。在《反恐精英:全球攻势》测试中,它表现出色,性能超现有机器人,还具提前预判移动等创新。

AIGC开放社区
开源动态7

全球闲置算力训个模型,性能媲美R1,老黄天塌了!Karpathy曾投资它

全球首个分布式RL训练模型INTELLECT - 2发布,整合闲置算力完成训练,成本降低,性能媲美DeepSeek - R1。其采用分布式异步强化学习范式,团队开源四大关键组件,还获Karpathy等投资,未来有多项计划。

量子位
算法论文8

AI长身体,直接做实验!自主通用科学家,科研界的Scaling Law来了

本文探讨未来科研范式「自主通用科学家」(AGS),它将AI与机器人技术结合实现科研全流程自动化,有望突破人类科研限制,引发科学范式变革,还介绍了相关架构、优势及面临的挑战和应对策略。

新智元
产品应用8

Qwen3-Embedding 全揭秘:从技术到服务,打造高效AI产品的关键路径

文章全面揭秘 Qwen3-Embedding,介绍其核心原理、优势、应用场景。还给出在 PAI 和百炼平台的使用方法,含部署、推理、微调等。通过对比实验,凸显其低延迟、低成本特点,未来将成语义理解核心设施。

阿里云开发者
推荐文章7

AI 赋能宇宙文旅?3位艺术家让你“触摸”星空,体验前所未有的情绪价值!

文章介绍三位青年艺术家周天行、徐诚开、姚心玥探索宇宙文化沉浸式叙事,以VR、AI等技术构建新叙事方向。还回顾其演变历程,展望未来,阐述该叙事在认知、文明等维度的意义及产品畅想。

MANA新媒体艺术站