「后训练技术」共找到 5968 篇相关文章
英伟达GPU全系列硬核科普手册:一文读懂NVIDIA芯片的定位、规格与应用场景
这是英伟达GPU全系列硬核科普手册,覆盖消费级、工作站、推理卡、训练卡及中国特供版五大产品线,讲清区别与用法,还介绍架构演进、命名规则等,助读者秒变选型高手。
「养龙虾」翻车实录:D盘没了、账号废了、余额清空了……
当下「养龙虾」(安装并训练 OpenClaw)火爆,腾讯、字节跳动等大厂纷纷入局,资本市场也很沸腾。但普通人「养龙虾」却状况百出,存在安全风险且烧钱,工信部也发布了安全预警。
重磅!小扎收购Manus,保持独立运营
Agent领域传来重磅消息,Meta以超10亿美元收购Manus,后者将保持独立运营,继续销售服务。其技术会整合进Meta产品,已服务全球数百万用户和企业,目标是服务Meta平台上更多用户。
万相2.6 X千问APP,功能价值和情绪价值兼具|甲子光年
12月16日阿里发布视频生成模型“万相2.6”,实现“角色扮演”功能突破。千问APP接入后上线“AI小剧场”,打破次元壁。千问兼具功能与情绪价值,阿里全栈布局助力其成“超级入口”。
4K超分Agent修图师来了!一键救活所有模糊照片
传统图像放大模型应对复杂情况力不从心,4KAgent应运而生。它基于多智能体设计,有感知、复原等模块,能为图像定制4K超分方案,在多领域测试中表现出色,无需特定领域再训练。
北航董雷霆等:数字工程与数字孪生在航空疲劳与结构完整性领域的研究进展与展望 | 航空学报CJA
疲劳与结构完整性贯穿飞机全生命周期,数字工程与数字孪生技术为其管理提供高效方案。文章梳理该技术研究进展、工程案例,涉及设计验证和使用维护两阶段,还对未来发展提出展望和建议。
The Batch: 882 | Qwen3-Next 提速
阿里巴巴对开源权重模型 Qwen3 全新升级,发布 Qwen3 - Next - 80B - A3B 的 Instruct 和 Thinking 版本权重。其融合新研究成果,推理能耗低、速度快,还优化架构和训练方法提升效率与稳定性。
把抖音的研发管理搬到车企,跑得动吗?
飞书项目在深圳新品发布会推出整车研发解决方案,首次明确‘平台化’定位并公开产品架构。其方案覆盖架构整合等四场景,还进行技术升级,如轻应用、Project 4K 计划等,已获车企实践验证。
腾讯提出Vision-SR1:让模型真正学会“看图思考”,而不是“蒙答案”
视觉语言模型(VLMs)存在视觉幻觉和语言捷径问题,限制其可靠性和泛化能力。腾讯提出Vision - SR1训练方法,通过推理分解和自我奖励机制,不依赖外部监督,提升模型视觉感知和推理可靠性。
上海又要冲出一个百亿芯片IPO
近日,瀚博半导体与中信证券签署上市辅导协议,冲刺A股科创板。其由前AMD核心技术领袖钱军、张磊创立,选差异化技术路径,已历6轮融资。当前国产GPU IPO潮起,瀚博有望借此抢占市场。