后训练系统」共找到 5104 篇相关文章

新闻资讯7

今起Codex每天重置一次!Tibo义父:首次3小时发放,重置时间可自选

今起付费却无法用GPT - 6 Astra的用户,每天能重置额度一次,首个额度不到3小时发放,可自选重置时间。还提到GPT - 6做长程任务超272K tokens部分不增额度消耗倍率,开放时间待定。此外介绍在其开放前可做的3件事。

量子位
新闻资讯7

Claude Code之父版「职场MBTI」:AI洗牌只剩5类人,你选哪种?

Claude Code之父Boris Cherny提出AI时代「职场MBTI」,含原型师、建造师等五类角色。他认为传统职能将被洗牌,未来是通才的黄金时代,还给出团队组队方案及个人自救建议。

量子位
算法论文8

大模型"温故而知新"实现了!无需历史数据,Octopus 效果超越全数据训练|CVPR‘26 Octopus

上海交通大学与vivo团队提出全新持续学习框架Octopus,首创无需历史数据的梯度正交化技术。实验显示,它在UCIT基准上表现超SOTA方法,还实现正向向迁移,适合端侧部署。

量子位
产品应用8

97年金融男带8只「电商龙虾」全球开店!2个月同行慌了

阿里版「电商龙虾」Accio Work打通国际站,一个工作台可全包选品、发品等七个岗位的活。它结合多维度数据助力选品,还能进行广告诊断、店铺运营等,在不同商家案例中成效显著。

新智元
开源动态8

写Verilog、调CUDA,总翻车?工业代码大模型开始学会「先想写」了

工业代码大模型缺的往往是‘想’的能力。北航联合多家单位提出的InCoder - 32B Thinking,让模型结合工业环境思考,通过ECoT从错误中学习,用ICWM提前预判结果,还能自适应思考深度,且模型与代码已开源。

机器之心
算法论文8

省下1.25倍算力!Kimi这篇论文,可能改写所有大模型的训练方式

大模型层数增多时,残差连接存在PreNorm稀释问题,导致面层贡献被稀释。Kimi论文提出Attention Residuals方案,还给出工程解法Block AttnRes,实验显示能省算力且提升效果。

AI寒武纪
算法论文8

ICLR 2026|多模态大模型真的理解情绪吗?MME-Emotion给出了系统答案

多模态大模型迅速发展,但能否理解人类情绪存疑,且缺乏系统性评测框架。香港中文大学和阿里通义实验室团队提出 MME - Emotion 评测基准,评测 20 个主流模型,发现模型情感智能不足,为续研究提供参考。

机器之心
产品应用8

OpenAI点赞转发的冠军项目,背藏着一个国人3D生成团队

近日,iOS产品StoryWorld获OpenAI Codex Hackathon冠军,其核心3D资产生成用了DeemosTech的Hyper3D Rodin。从黑客松到英伟达工程场景,3D生成重稳定性等特性。Hyper3D团队技术强,发布编辑功能,推动3D生成走向可控。

机器之心
新闻资讯7

原来Grok是36个小时极限卷出来的!xAI创始成员离职放开说了

xAI前创始成员托比哥爆料,马斯克要求团队36小时内发布Grok。当时团队仅10人,面对半成品,高强度连轴转完成开发,使其走红。还提到马斯克硬核工作文化,虽压力大但成果显著。

量子位
算法论文8

北大卢宗青团队新作:超 70% 实机成功率,支持语言指令的功能性抓取系统

现有抓取研究多在稳定性层面,而功能性抓取更接近真实世界的智能。北大卢宗青团队提出DemoFunGrasp方法,对功能性抓取重新建模,在仿真与真实场景均超70%成功率,还引入视觉语言模型让机器人理解语言指令。

AI科技评论