「M1」共找到 1839 篇相关文章
OpenAI官宣自研首颗芯片,AI界「M1时刻」九个月杀到!联手博通三年10GW
OpenAI官宣与博通合作造AI芯片,预计2029年底部署10GW算力。内部已研发18个月,首颗芯片9个月后量产。双方将垂直整合技术栈,还会用ChatGPT设计芯片,目标是实现算力充裕。
NextStep-1:一次在图像生成上自回归范式的探索
阶跃星辰团队探索自回归图像生成新路径,推出 NextStep-1。它直接在连续视觉空间自回归生成,架构简洁,实现端到端训练。模型有高保真生成和编辑能力,Benchmark 表现佳,但也面临稳定性等挑战。
黄仁勋联手OpenAI前高管,1吉瓦超级算力明年开闸
英伟达CEO黄仁勋与前OpenAI高管Mira Murati的初创公司Thinking Machines Lab达成「吉瓦级」合作,将部署至少1吉瓦下一代NVIDIA Vera Rubin系统,明年初启动,背后涉及数百亿美元,也引发对「循环融资」的担忧。
10万美元一张!美国H-1B暴涨引爆硅谷与学界
9月19日特朗普宣布将H-1B签证单次申请费猛涨至10万美元,美国学界业界一片哗然。高校面临人才短缺、费用负担重问题,科技初创企业或遭灭顶之灾,但也有人认为能筛选顶尖人才。
3D-R1:让AI理解3D世界的下一步
文章介绍新研究3D - R1,它是更通用、具推理能力的三维视觉语言模型,解决了当前3D VLM空间理解不足与推理能力薄弱问题,在多任务测试领先,有广阔应用前景。
「推理革命」爆发100天:DeepSeek-R1复现研究全揭秘!
本文深入梳理围绕DeepSeek-R1的复现研究,解析监督微调、强化学习等关键技术细节,介绍相关数据集、训练方法及奖励机制等,还探讨了推理语言模型更多发展方向,为研究提供基础。
The Batch: 948 | GLM 5.1:面向长时任务的能力提升
Z.ai将旗舰开源权重大语言模型升级为GLM - 5.1,可在单个任务自主运行八小时。它专为编程和智能体任务设计,有推理等特性,在多榜单表现佳,但推理和数学能力落后闭源模型,价格有提升。
Cursor 1.0 正式发布:AI 代码编辑器进入“自动审查 + 记忆”时代!
智能代码编辑器 Cursor 正式发布 1.0 版本,带来多项重磅功能,如自动代码审查助手 BugBot、Jupyter Notebook 原生支持、项目级 AI 记忆等,还提升了用户体验,是向“AI 编程操作系统”迈进的重要一步。
V4或Code要来?刚刚,DeepSeek-V3.1-Terminus发布!
DeepSeek线上模型升级为DeepSeek-V3.1-Terminus,单从名字看像是V3终极版,或在筹备V4及Code模型。deepseek - chat和deepseek - reasoner完成升级,此次更新改进语言一致性,优化Agent能力。
MiniMax M3 实测:第一流的模型,已经对执行层动手了
文章对 MiniMax M3 模型进行多维度实测。它强化 Coding 与 Agent 能力,能完成长任务,与 Sonnet 4.6 竞技各有优势,多模态能力强,价格有竞争力,MiniMax Code 意在争夺开发者工作流入口。