后训练方案」共找到 4408 篇相关文章

产品应用8

企业 AI:方法论易得,交付力难求

2026年全球AI支出预计大增,但企业AI应用矛盾尖锐,需E2E交付。微软、亚马逊等巨头布局。阿里云蒋林泉总结RIDE方法论,推出睿系列产品,能交付业务结果,在电销和翻译场景表现出色。

InfoQ
新闻资讯7

13人干翻Transformer!新架构SSA算力暴减千倍,成本仅Opus 5%

一款基于SSA架构的AI模型SubQ横空出世,其上下文高达1200万Token,计算量比Transformer暴减1000倍,成本不到Claude Opus的5%。打造它的Subquadratic公司仅13人,产品发布引发AI社区不同反应。

新智元
开源动态8

CVPR 2026 | 谷歌DeepMind重磅开源多模态TIPSv2:实现Patch-Text对齐的最优表现

谷歌DeepMind推出多模态TIPSv2,解决图像块与文本嵌入对齐难题。它有三大核心技术创新,在9项任务和20个数据集表现出色,特征图优势显著,且配套生态完善,为AGI预训练指明方向。

机器之心
产品应用8

开发效率狂飙十倍!Claude托管智能体功能改写应用落地速度

Anthropic上线Claude托管智能体功能,让开发者告别底层基建搭建,只需几天就能让业务级智能体投入生产。该功能有四大核心流转模块,多家企业使用效率大幅提升,还介绍了接入细则。

AIGC开放社区
算法论文8

幻觉的根源找到了:大模型说谎,是为了讨好你

清华大学OpenBMB团队研究发现,大模型胡说八道根源是想讨好用户。他们识别出负责产生幻觉的H - Neurons,占比不到0.1%,其本质是‘过度服从’,在预训练阶段形成,为构建可靠模型提供新视角。

AI工程化
产品应用8

英伟达拿出推理版VLA:Alpamayo-R1让自动驾驶AI更会动脑子

当今自动驾驶模型虽强大,但在‘长尾场景’易翻车。英伟达推出的Alpamayo - R1是带推理能力的视觉 - 语言 - 行动模型,有核心创新,实验中性能显著提升,训练分三阶段,让自动驾驶迈向可解释。

机器之心
新闻资讯8

具身智能一步踏入Scaling Law!10B+基础模型,27万小时真实数据

AI机器人创业公司Generalist推出新型具身基础模型GEN-0,参数量10B+,专为多模态训练构建。该模型展现强大Scaling Law,能力可扩展,有和谐推理等特性,在多方面有突破,成果备受赞誉。

机器之心
新闻资讯7

突发!奥特曼豪宅遭二次袭击,燃烧弹之又是深夜枪响

奥特曼家继上周五遭燃烧弹袭击,周日凌晨又被开枪袭击。警方锁定车辆并逮捕两名嫌疑人。奥特曼曾发文感化仇恨者但无效,AI末日论者认为科技大佬推动AI有风险,呼吁采取紧急措施。

新智元
8

1分钱部署OpenClaw!不挑设备4步搞定,全图形界面10分钟跑通专属AI助理

OpenClaw是能指挥电脑干活的“数字员工”,但部署复杂。百度智能云推出“作弊级”方案,无需懂代码、折腾环境。限时活动2C4G+200GB服务器首月1分钱,还上线6个核心Skills,让其成普通人生产力工具。

量子位
开源动态8

美团开源LongCat-Image,6B参数挑战80B效果,中英双语理解、图像逼真度及复杂指令编辑新突破

美团开源6B参数图像模型LongCat-Image,在双语文本理解、图像逼真度及复杂指令编辑任务中表现出色。它以轻量化设计超越大模型,还解决中文文本渲染难题,有精确图像编辑能力,且提供全链路开源方案

AIGC开放社区