「大模型训练」共找到 9520 篇相关文章
Think in Games:做一个在王者荣耀中会玩和思考的Agent
文章介绍论文《Think in Games: Learning to Reason in Games via Reinforcement Learning with Large Language Models》,指出当前AI在游戏领域面临的困境,提出TiG框架结合大语言模型与强化学习,打造既会做又会说的AI,实验验证其高效性。
Nature报道:谷歌新模型1秒读懂DNA变异!首次统一基因组全任务,性能碾压现有模型
谷歌DeepMind团队推出生物模型AlphaGenome,能从1兆碱基DNA序列中预测数千种功能基因组特征,评估变异效应。它统一多任务,性能超现有模型,是生物领域里程碑,将助力理解疾病。
抢先李飞飞!世界模型能多人联机玩FPS游戏了
Odyssey公司推出世界模型Agora - 1,驱动网页版多人FPS游戏,无游戏引擎等,画面实时生成。该公司专注通用世界模型,此前业务转向主动交互,此成果解决多人游戏一致性难题,还发布多模态模型Starchild - 1。
一夜之间OpenAI神秘模型“o3-alpha”刷爆时间线:远胜 Claude Sonnet
OpenAI神秘新模型“o3-alpha”正在测试,刷爆时间线。早期测试显示其性能超强,能一键生成游戏,前端编码能力远胜Sonnet、o3等。有猜测它是AHC模型或OpenAI将开源的模型。
OpenAI新模型Day0就被嫌弃!排名拉垮,不如一月底发布的国产模型
OpenAI推出GPT - 5.4 mini和nano模型,主打快速经济,针对编程等优化。但评测中GPT - 5.4 mini排名不佳,不如国产Kimi 2.5,且价格对比有争议。不过与自家旧版比有提升,网友测试有亮点。
实测新版LiblibAI:终于把模型、生图、工作流塞进一个碗了
本文实测新版LiblibAI,它上线多个模型,添加视频特效玩法。从“找模型”网站变为“AIGC流水线”平台,界面风格转变。虽有亮点,但也存在出图慢、模型惊喜感弱、页面卡顿等问题。
7万个模型、1600万开发者,阿里魔搭已建成中国最大AI开源社区
首届魔搭开发者大会公布,魔搭社区开源模型超7万个,用户达1600万,成中国最大AI开源社区。阿里云CTO周靖人认为‘云端协同’是重要课题,魔搭要覆盖模型全生命周期,减少模型落地差距。
把AI 时代最重要的判断力当专业学科训练,专注提升判断力
文章指出AI时代人们多只有“领域内判断力”,判断力可当学科训练。介绍预测大赛中普通人表现超CIA分析师,1小时训练能提升10%准确度,还给出判断力3层栈框架及30天训练清单。
当世界模型不止「视频」该如何评估?WorldLens提出实用化评估新框架
生成式世界模型在多领域进展显著,但评估存在局限。WorldBench 团队构建 WorldLens 评测框架,从五个维度评测开源世界模型,其评测 EvalKit 已公开,可暴露模型能力边界与失效模式。
豆包也开始抢程序员饭碗了,首个编程模型来了!
字节给豆包升级编程能力,推出首款编程模型Doubao - Seed - Code。它刷新国内编程模型上下文长度,支持视觉理解,API价格良心。经测试,虽未达全球顶尖,但弥补国产编程模型短板。