FP4训练」共找到 3436 篇相关文章

新闻资讯8

7 小时连续重构不掉线!一骑绝尘的Claude 终于遇到对手:Greg Brockman亲自解读AI编程重大突破

9月16日,OpenAI推出新模型GPT-5-Codex,专为AI辅助编程工具设计。它在代理编码基准测试中表现佳,形成了覆盖各种需求的交互界面,还具有更优的后训练特性,能连续工作7小时完成复杂重构。

InfoQ
新闻资讯7

Q2 GPU市场,英伟达独占94%,AMD被逼上绝路?

权威机构JPR报告显示,2025年Q2全球PC用GPU出货量环比增8.4%,CPU出货量也同步增长。这是关税恐慌引发的‘囤货潮’所致。英伟达在GPU领域优势巨大,AMD在CPU战场表现出色,三家旗舰产品各有特色。

AIGC开放社区
算法论文8

1052篇文献!上海AI Lab发布科学LLM综述:从数据基础到Agent前沿

上海AI Lab主导,25家研究机构共同梳理270+训练集、190+评测集,提出科学数据分层框架与智能体闭环科研新范式。还介绍了模型演进、数据情况、评估基准等,指出数据缺陷并展望走向科学家智能体的三步。

PaperAgent
新闻资讯7

GPT-5被批过度炒作、性能落后,OpenAI联创揭秘其中原因:我们把它关在 “象牙塔”,和现实世界接触不够

OpenAI发布GPT - 5后遭遇波折,因被批不直观恢复为GPT - 4。但它是进军企业市场举措,获部分企业认可。OpenAI联合创始人Greg Brockman谈其发展历程、瓶颈、应用等,强调让模型接触现实、提升安全性及适配团队工作。

AI前线
8

GPT-5暴写「屎山代码」!14个Prompt,看穿GPT-1到GPT-5七年智商进化史

GPT-5发布半月表现未达预期,Peter Gostev对比GPT-4和GPT-5基准测试。OpenAI公开2018 - 2025 GPT进展网址,通过14个Prompt展示GPT-1到GPT-5在写诗、写代码、解题、解答专业与健康问题等方面的实力进化。

新智元
开源动态8

腾讯混元开源 4 个小尺寸模型,主打 Agent 和长文

8月4日腾讯混元开源四款小尺寸模型,参数为0.5B、1.8B、4B、7B,消费级显卡可运行。模型推理快、性价比高,在多领域表现出色,亮点是Agent和长文能力,已在腾讯多业务应用。

AI前线
开源动态8

超越DeepSeek-R1,数学形式化准确率飙升至84% | 字节&南大开源

字节跳动Seed团队与南京大学联合发布CriticLean框架,将数学自然语言到Lean 4代码的形式化准确率从38%提升至84%。该框架创新性地将评估模型置于核心,解决语义对齐等问题,还构建了相关基准测试和数据集。

量子位
新闻资讯8

预测太阳磁暴全球最强!首个空间天气链式AI预报模型亮相WAIC

在WAIC上,我国发布全球首个全链式空间天气AI预报模型“风宇”。它首创链式训练结构,整合孤立环节;基于天地一体化观测数据,在多区域短临预测表现卓越,误差低,已申请多项专利,还可用于航天器设计管理。

量子位
开源动态8

深夜开源首个万亿模型K2,压力给到OpenAI,Kimi时刻要来了?

昨晚,月之暗面发布并开源 Kimi K2 大模型,同步上线更新 API,价格 16 元/百万 token 输出。它超过多个开源和闭源模型成新 SOTA,展示出领先能力,还介绍训练关键技术,或成模型智能进化关键。

机器之心
新闻资讯7

Gemini 2.5 Pro 负责人:最强百万上下文,做好了能解锁很多应用场景

谷歌DeepMind长上下文预训练联合负责人Nikolay Savinov在播客中分享Gemini 2.5长上下文技术。他认为长上下文能革新产品交互,与RAG协同,未来千万级token上下文将成标配,但当前百万级未达完美时扩规模意义不大。

Founder Park