「AI开发环境」共找到 10475 篇相关文章

产品应用7

vLLM 技巧: 在几秒钟内无需重启释放90%的 GPU 显存

EmbeddedLLM介绍vLLM新功能“休眠模式”,可在不重启服务时几秒内释放约90% GPU显存,实现模型热插拔与高效轮转,还介绍使用方法、不同休眠级别,提醒生产环境要确保安全。

AI工程化
新闻资讯8

刚刚,Meta宣布正式成立「超级智能实验室」!11人豪华团队首曝光,

据彭博社消息,扎克伯格在内部备忘录宣布重组AI团队,合并到新成立的「Meta超级智能实验室」,由Alexandr Wang领导,还曝光11位从OpenAI等挖来的人才,将致力于开发Llama系列模型等。

机器之心
算法论文8

大模型“拼好题”,45K数据撬动18%提升,数学问题拒绝死记硬背 | MathFusion

上海AI Lab等团队提出MathFusion,通过三种“融合策略”生成新的融合数据集MathFusionQA,仅用45K合成指令,在多基准测试中平均准确率提升18.0个百分点,增强模型解决数学问题的能力。

量子位
开源动态8

完全开源的7B模型,性能比肩主流LLM,训练成本仅16万美元,复现DeepSeek的强化学习!

Moxin-7B由多机构团队联合开发,遵循“开源科学”原则,公开全流程细节。它训练成本仅16万美元,评测表现亮眼,在架构、数据策略、训练过程等方面有创新,为中小企业提供可控AI方案。

AI科技大本营
新闻资讯7

阿里云的“反差”2025:于无声处寻找 ASI

2025年云栖大会上,吴泳铭称实现AGI是确定事件,ASI才是终局。实现ASI需满足两大条件,结合阿里投资计划,阿里云将成企业AI时代支撑者。虽市场份额增长,但利润下降,2025年阿里云极具“反差感”。

InfoQ
算法论文7

CodeClash 通过多轮编程竞赛对大型语言模型进行基准测试

为评估大型语言模型(LLM)编码能力,斯坦福、普林斯顿和康奈尔研究人员开发 CodeClash 基准测试,让多个 LLM 在多轮比赛中较量,涉及多种代码竞技场,还评估模型分析代码库能力,未来将处理更大代码库。

InfoQ
产品应用7

Dia 没死,人家转手就发了 1.x 版本

OpenAI 发布浏览器 Atlas 引发讨论,有人认为其有缺陷会失败,也有人觉得初创 AI 浏览器会被巨头收割。以 Dia 为例,它被收购后加快迭代,推出 Skills Gallery、Research 等功能,还新增连接 App 等特性。

MacTalk
推荐文章7

“被投资人怒怼30分钟后,我更确定中国To B的答案” | 甲子光年

文章讲述百融云创在AI To B领域的探索。它突破传统“卖工具”模式,采用“结果计价”,共担结果、承包KPI。技术上提前押注语音对话技术栈,“硅基员工”概念落地多场景,有望推动中国To B行业进入新秩序。

甲子光年
产品应用7

实测美团 LongCat:快到极致,但是别说追平 DeepSeek

AI科技评论实测美团LongCat-Flash-Chat,它是中量级对话模型,主打“快”,几乎零延迟。但在推理、抗污染能力等测试中,相比DeepSeek-V3.1,逻辑链条松散,缺乏清晰判断。速度与逻辑哪个更重要,值得思考。

AI科技评论
开源动态7

比NotebookLM更好的「开源播客」,可根据多模态内容生成30分钟以上播客音频。

Podcastfy是开源Python工具,能把文本、图片等多模态内容,借生成式AI转化为播客。它支持自定义,适配多种语言和文本转语音模型,能生成2 - 5分钟或30分钟以上的播客,使用体验比NotebookLM好。

开源AI项目落地