DeepSeek-R1-Distill-Qwen-1.5B」共找到 2448 篇相关文章

产品应用7

SpecKit 在成熟 Java 项目中的 AI 编码实践

文章分享SpecKit在成熟Java项目的AI编码实践,引入其作为规范管理工具,按标准化流程操作。介绍选型、环境准备、执行步骤,分析优缺点,还提及Qwen - Image解决AI绘画文字问题。

阿里云开发者
新闻资讯7

10万亿算力订单根本hold不住?Altman偷递11页“要钱申请”,还嘴硬 “不求联邦”,白宫直拒:谁都不救!

近日,OpenAI 就财务状况表态引发混乱,面临不诚实指控。首席财务官提议政府‘支持’公司基础设施贷款后又收回表述,白宫 AI 主管称不会救助。Altman 否认寻求担保,但公司信函细节与之冲突。

AI前线
新闻资讯7

AI助手Cici悄然霸榜海外,又是字节

AI智能助手领域有新玩家,字节跳动的Cici在多个国家应用商店霸榜,数月内下载量爆发式增长。它融合字节旗下技术,文本生成用到OpenAI、谷歌模型。同时,豆包在国内AI智能助手赛道全维度领先。

量子位
新闻资讯7

OpenAI 4 名王牌研究员“叛变”,Meta 上亿美元的签约奖金终于花出去了

近日,Meta 招募 4 名前 OpenAI 研究员加入超级智能实验室。招聘背景是其 Llama 4 Behemoth 模型有性能问题。Meta 还以高额奖金挖角,且不局限于 OpenAI,还投入巨资支持 AI 项目。

AI前线
算法论文7

美7000万人或被取代,Agent光速卷入职场!北大校友、杨笛一新作

斯坦福大学研究团队调查104个职业领域1500名专家及52名AI研究员,构建WORKBank数据库。研究发现职场AI需求与能力错配,工人对AI态度不一,还揭示未来人类技能变化趋势。

新智元
算法论文8

知识类型视角切入,全面评测图像编辑模型推理能力:所有模型在「程序性推理」方面表现不佳

东南大学等团队提出KRIS - Bench,从知识类型视角对图像编辑模型推理能力评测。它分三大知识范畴、细化多种任务,设四维度评估指标,测10款模型,发现模型程序性推理等能力不足。

量子位
开源动态8

开启端侧长文本时代!面壁全新架构,让小钢炮最快提升220倍

2025智源大会上,面壁智能发布MiniCPM 4.0模型,实现行业首个系统级上下文稀疏语言模型创新。它在端侧推理任务上表现出色,降低缓存需求,提高运行效能,还进行多维度架构创新,是AI领域探索高效率语言模型的里程碑。

机器之心
新闻资讯7

4万多名作者挤破头,CVPR 2025官方揭秘三大爆款主题, 你卷对方向了吗?

CVPR 2025 官方根据 4 万多名作者 13008 份投稿,总结出计算机视觉热门的三大方向,即基于多视角与传感器的 3D 技术、图像与视频合成、多模态学习(视觉、语言和推理),并介绍了各方向热门原因。

机器之心
新闻资讯7

印度国家级大模型上线两天仅 300 余次下载,投资人直呼“尴尬”:韩国大学生模型都有20万!

印度 Sarvam AI 发布国家级模型 Sarvam - M,虽被赞为本土 AI 研究突破,支持 10 种印度本地语言,但上线两天仅 334 次下载,投资人批评其成果‘令人尴尬’,引发社区激烈争论。

InfoQ
开源动态8

卡内基梅隆大学开源LegoGPT,用AI设计乐高模型

卡内基梅隆大学开源LegoGPT,可依文本提示生成物理乐高模型。它把乐高设计转为自回归文本生成任务,基于LLaMA - 3.2 - 1B - Instruct微调,应用场景广泛,如教育、玩具设计等。

AIGC开放社区