有监督微调」共找到 6441 篇相关文章

产品应用8

Deepseek V4 Pro发布,除了多模态,满足我对模型的所想象

DeepSeek官方文档更新模型日期,意味着DeepSeek V4 Pro正式版来临,已在官方API提供。它采用MoE设计,接口能力强,Agent能力得到大幅强化,评测成绩亮眼,价格实惠且API兼容性,不过并发限制,近期还将上调价格。

鲸选AI
开源动态8

1.4K Star!不要问答,要完成任务,一个合格的金融Agent应该是什么样?

过去一年AI Agent火热,但金融场景投研是长链路任务,诸多硬约束。LangAlpha是Ginlix AI推出的开源金融Agent项目,能解决实际金融研究任务,核心架构和关键能力,还给出使用方式、典型Demo及横向评测。

开源星探
开源动态8

读完这篇,你就搞懂 DeepSeek v4 了

2026年4月24日,DeepSeek全新系列模型DeepSeek - V4预览版上线并开源,评分接近‘闭源三巨头’。该模型强在1.6T参数+1M上下文,还从attention到kernel的系统级重构与优化,在架构和工程层面均创新。

腾讯技术工程
新闻资讯7

史诗级翻车!苹果旗舰被曝半停产,库克赌输了?

业内人士爆料苹果基本暂停对Vision Pro产业端的维护,意味着该产品进入半停产阶段。Vision Pro定价高、功能体验不佳、生态封闭,导致市场失败。同时,三星Galaxy XR虽安卓生态优势,但也面临诸多问题。

芯师爷
新闻资讯7

中美算力,站在2000亿美元的分岔路口

高盛报告称2025年全球人工智能投资规模或接近2000亿美元。中美算力发展站在分岔路,中国追性能,美国被能源限制。全球算力市场新变化,中国本土芯片崛起,各方也在热议AI是否泡沫。

芯师爷
推荐文章7

生成式推荐!推荐系统新范式还是新噱头?【文末抽现金红包】

文章探讨生成式推荐是新范式还是噱头。分析其与判别式推荐区别、效果收益来源,结合Meta GR、快手OneRec实例,指出其提升但非万能,不同团队应按需选择,还提及可能带来架构革新。

王喆的AI笔记
推荐文章7

人才济济的大厂,为何频频产出垃圾代码?

科技大厂常产出垃圾代码,原因在于多数代码变更由菜鸟工程师完成,他们经验不足且常处于摸索状态。老手虽优势,但过度依赖问题。大厂为调度人才牺牲代码质量,这在AI时代隐患更大。

InfoQ
开源动态8

Meta刚刚开源的SAM 3D火爆全网,未来2D=3D。

近日AI圈热闹,Gemini、GPT、Grok相继更新,Meta虽未更新小羊驼,却发布开源3D模型SAM 3D。它能精确重建人或物体3D模型,真实三维感知,两模型,性能强,应用场景多。

开源AI项目落地
开源动态7

为老父亲做的桌面 Agent,不小心在 GitHub 霸榜一周

OpenHuman是TinyHumans AI构建的开源桌面AI Agent,登上GitHub榜单并霸榜一周。它想成桌面级个人AI操作系统入口,但使用体验与愿景差距,工程架构亮点,也存在安全风险,其产品哲学价值但执行粗糙。

AI科技评论
新闻资讯8

GPT-5编程专用版发布!独立连续编程7小时,简单任务提速10倍,VS Code就能用

OpenAI推出GPT-5-Codex特化版模型,支持独立连续编程7小时,IDE插件版。新模型“真·动态思考”能力,简单任务提速10倍,复杂任务推理更久。还重构了Codex产品体系,升级IDE扩展等。

量子位