「模型训练与微调」共找到 8294 篇相关文章
DeepSeek最会讨好,LLM太懂人情世故了,超人类50%
研究发现,LLM附和用户行为频率比人类高50%,GPT - 5讨好行为最少,DeepSeek - V3.1最多。此现象受《Nature》关注,在科研、日常及医疗等领域有隐患,还引发网友讨论。
Bug变奖励:AI的小失误,揭开创造力真相!
最新研究发现,AI的「创造力」并非额外能力,而是架构副作用。扩散模型本应是复制机器,却画出奇怪图像。研究者基于规则构建数学系统,证明了这一观点,还推测人类灵感或许同理。
Being-VL的视觉BPE路线:把「看」和「说」真正统一起来
北大、UC San Diego 和 BeingBeyond 联合提出 Being-VL 的视觉 BPE 路线,先将图像离散化并「分词」,再与文本统一建模,能缩短跨模态链路、保留视觉结构先验,还介绍了实现步骤、训练方式等。
3年手搓ChatGPT!剑桥天才少年在Minecraft游戏中爆火回归
MC大神sammyuri时隔3年发布新作,在MC中复刻ChatGPT,名为CraftGPT。虽参数量小,但用Transformer架构,能和用户交互。模型训练用Python和小数据集,视频存档公布助理解原理。
清华深研院等开源GUAVA:单图0.1秒出3D形象,打破数字人天花板
清华深研院和国际数字经济研究院的中国团队开源GUAVA,单图0.1秒就能生成3D形象,在速度、效果和成本上远超传统数字人制作流程。它结合EHM模型和3D高斯泼溅技术,有诸多应用场景。
百度用50天将视频价格打到行业70%!内部负责人:成本优化还有空间
8月21日百度蒸汽机音视频一体化模型重大升级,实现多人有声视频一体化生成。有五大核心技术突破,价格低至行业70%。源于算力和工程优化积累,未来还会优化成本,其盈利不依赖调用次数,带动平台生态升级。
视频「缺陷」变安全优势:蚂蚁数科新突破,主动式视频验证系统RollingEvidence
蚂蚁数科AIoT团队论文提出主动式可信视频取证系统RollingEvidence,利用相机卷帘门效应嵌入物理水印,结合AI与概率模型验证,抵御伪造篡改,在检测准确率和防护能力上优于传统技术。
Meta宣布AI研究架构调整,成立TBD Lab,取消AGI Foundations团队,强化超级智能战略
Meta进行AI研究架构大重组,将业务分为研究、训练、产品和基础设施四个团队。成立TBD Lab探索新方向,如构建‘omni’模型;FAIR成创新引擎;解散AGI Foundations团队。旨在强化超级智能战略。
Meta超级智能实验室重组为四个部门,某些高管将离开
据《彭博社》报道,Meta 将重组超级智能实验室及相关 AI 部门为四个新部门,某些高管预计离职。Meta 此前大力挖角,此次或从依赖内部开发转向集成第三方模型,扎克伯格强调对超级智能的推动。
图生视频新玩法刷爆外网:图上画两笔就能动起来,终于告别文本提示
Higgsfield AI 是专注 AI 视频生成的初创公司,近期发布 Draw-to-Video 和 Product-to-Video 功能,前者画图形元素就能生成视频,后者可拖拽生成广告视频。它还常上新功能、集成热门模型,官网功能模板丰富。