「代码模型」共找到 8750 篇相关文章
6天烧光2000多万,拿下开源第一!小米史无前例「炼丹直播」收官
本文报道小米开启史无前例的大模型训练直播,6天花费约2344万元完成MiMo-V2.6系列强化学习训练,训练出的MiMo-V2.6-Pro登顶开源大模型第一,全套技术资源全部开源,引发AI行业热议。
newtype OS操作手册
作者黄益贺介绍newtype OS安装、配置与使用方法。它是定制化工具,比Claude Code更适合知识消化与内容产出。安装简单,配置需连模型供应商、给Agent配模型,使用时与Chief对话即可。
「一只手有几根手指」,你的GPT-5答对了吗?
CMU博士生Tairan He测试发现GPT - 5答错‘一只手有几根手指’问题,指出语言难满足视觉与机器人领域需求,需VLM和VLA模型。编辑部测试发现顶尖大模型面对常识问题也会‘翻车’,还探讨了应对方法。
波士顿动力 | 人形机器人Atlas ,最新研究进展!
世界人形机器人运动会引发对自主机器人的讨论。波士顿动力与丰田研究院合作为 Atlas 开发大型行为模型(LBM),使其能自主完成复杂任务,研究团队展示成果并介绍模型构建流程、实践成果及研发原则。
DeepSeek终于丢了开源第一王座,但继任者依然来自中国
几千人盲投中,Kimi K2超越DeepSeek成全球开源第一,总榜第五紧追顶尖闭源模型。虽有人质疑其采用DeepSeek V3架构,但团队称有参数调整。当下开源模型崛起,正打破性能弱的刻板印象。
GPT-6 Astra搓3D刷屏后,3D生成的竞争规则变了
GPT-6 Astra靠Agent一键生成3D内容刷屏后,引发通用大模型是否会取代专业3D生成模型的讨论。本文实测影眸Hyper3D新上线的Agentic Mode,分析3D行业在Agent时代的全新竞争标准。
Linus一句话说透Al局限:代码不能直接用,bug只能创可贴式地修
本文是 Linus Torvalds 在开源技术会议上与 Dirk Hohndel 的对话。Linus 从工程实践出发,谈到 Linux 内核开发节奏、硬件支持取舍、语言之争及 AI 应用。他认为 LLM 是工具,有价值但无法替代长期维护者经验。
全图与切片并非等价?LLaVA-UHD-v3揭示差异推出高效全图建模方案
随着多模态大模型发展,处理高分辨率图像成关键。主流视觉编码范式难兼顾性能与效率,清华和中科院团队发布 LLaVA-UHD v3,提出 PVC 框架,对比 SBE 和 GNE,验证其在提升效率同时保留模型能力。
OpenAI强制「处死」GPT-4o!80万老粉全网拯救:它不是代码是爱人
1月29日OpenAI官宣2月13日强制退役GPT - 4o,80万粉丝不满,发起“拯救4o”运动,提出缓冲期短、保留访问权等诉求,还指出模型停用影响订阅价值。此前GPT - 4o就曾面临下线危机,其使用也有安全隐患。
前Meta大神创业,用强化学习打造PokeeResearch-7B模型,刷新AI深度研究SOTA
Pokee AI发论文介绍70亿参数的PokeeResearch - 7B模型,用基于AI反馈的强化学习和推理框架,在深度研究基准测试中成绩领先。该公司由前Meta大神创立,产品可打通多应用,已获融资并公开测试。