「AI模型训练」共找到 13660 篇相关文章
更高智商更快思考!蚂蚁开源最新万亿语言模型,多项复杂推理SOTA
蚂蚁正式发布拥有万亿参数的通用语言模型Ling-1T,超越多个开源和闭源模型,在多项复杂推理基准中取得SOTA表现。它推理和代码能力强,研发采用‘中训练+后训练’,还提出新奖励机制和LPO方法。
刚刚,全球AI生图新王诞生!腾讯混元图像3.0登顶了
LMArena竞技场发布文生图榜单,腾讯混元图像3.0夺冠,超越谷歌、字节和OpenAI等模型。它是原生多模态模型,语义理解强,核心技术独特,经多阶段训练,效果能与顶尖模型媲美。
实测!DeepSeek V4-pro是第一个接近Claude开源模型,前Meta研究员震惊
DAIR.AI创始人、前Meta AI研究员Elvis用DeepSeek - V4 - Pro在Pi框架搭LLM知识库,该模型开箱即用,完成知识密集型多步研究任务表现出色,在开源模型里Agent编程和推理能力强,架构设计让推理快且成本低。
内部爆料,OpenAI 将发布神秘「OS模型」,员工惊掉下巴
OpenAI研究员Aidan McLaughlin推文称试用新os模型后很震惊,引发猜测。有推测是GPT - 5,也有认为OS可能指开源模型、新的o4模型或操作系统。从代码看,OpenAI或把ChatGPT升级为AI操作系统。
对谈 Memories AI 创始人 Shawn: 给 AI 做一套“视觉海马体”|Best Minds
本文是对 Memories AI 创始人 Shawn 的访谈。他指出当下 AI 记忆多为“上下文工程”,其团队致力于打造视觉记忆层 LVMM。还探讨了视觉与文本记忆区别、LVMM 架构及应用场景等,认为视觉记忆将成下一代 AI 核心。
谷歌AI Studio大更新:推出全新“vibe编程体验”,一键生成AI应用,好用到爆
谷歌AI Studio发布全新vibe编程体验,可一键生成AI应用。基于Gemini API,启动界面有功能建议,还有“手气不错”按钮。构建问答游戏不到1分钟,免费且可编辑代码,还有AI建议功能,适合小白。
知识类型视角切入,全面评测图像编辑模型推理能力:所有模型在「程序性推理」方面表现不佳
东南大学等团队提出KRIS - Bench,从知识类型视角对图像编辑模型推理能力评测。它分三大知识范畴、细化多种任务,设四维度评估指标,测10款模型,发现模型程序性推理等能力不足。
首个基因推理AI 横空出世!准确率飙至97%,彻底改变基因组学研究
多伦多大学等团队发布全球首个基因推理AI模型BioReason,将DNA基础模型与大语言模型融合,准确率从88%提至97%,可解释基因组变异致病机制,有望上线Hugging Face,应用前景广。
刚刚,最佳VLA模型GigaBrain-0开源:世界模型驱动10倍数据,真机碾压SOTA
近日,极佳视界与湖北人形机器人创新中心联合发布端到端VLA具身基础模型GigaBrain - 0,这是国内首个用世界模型生成数据实现真机泛化的模型,后续将全面开源,能完成复杂操作,实验成功率超SOTA方法。
Qwen3深夜开源新系列:文本表征模型,3种尺寸可选,超越商业API拿下SOTA
Qwen3深夜上新Embedding系列,专为文本表征等任务设计,在Qwen3基础模型上训练,有0.6B/4B/8B三种尺寸,8B版本在MTEB榜单排第一,性能超商业API,已在多平台开源。