GPT4o」共找到 2300 篇相关文章

算法论文7

震撼实锤!清华姚班校友揭「1.4×加速」陷阱:AI优化器为何名不符实?

为降低大模型预训练成本,近年新优化器频出,宣称加速1.4×到2×却难落地。斯坦福研究指出方法学缺陷,对比不同缩放范式加速差异,给出优化器设计见解,证实严格基准评测必要。

新智元
开源动态8

SVG性能比肩GPT/Claude,腾讯开源3B模型HiVG,让Token「懂几何」

腾讯混元团队开源仅3B参数的HiVG,它是面向SVG生成的层次化分词框架,减少63.8% token数量,多项指标超越GPT-5.2等闭源模型及8B级开源模型,还在人类评测中表现出色。

量子位
算法论文8

Anthropic:大模型开始意识到自己在想什么!

Anthropic的Jack Lindsey论文《Emergent Introspective Awareness in Large Language Models》对大模型做神经科学受控实验。发现Claude Opus 4/4.1能感知内部念头,区分内外状态,通过检查内部状态一致性判断输出意图。

深度学习自然语言处理
开源动态8

英伟达成开源新王?Nemotron 3全新混合专家架构,推理效率升4

北京时间今天凌晨,英伟达发布 Nemotron 3 系列开放模型,含 Nano、Super 和 Ultra 三种规模。Nano 已上线 Hugging Face,采用混合 MoE 架构,推理效率提升显著。该系列还具备多种核心技术和实用能力,相关工具和数据集也已开源。

机器之心
新闻资讯7

OpenAI 盲测新模型不如 Nano Banana Pro?曝 Altman 要暂停 Sora,死磕 ChatGPT

近日,网友发现 Notion 或在测试 GPT - 5.2。OpenAI 盲测新图像模型‘Chestnut’和‘Hazelnut’,结果接近 Nano Banana Pro,但生成图未获好评。Altman 调整战略,暂停 Sora 死磕 ChatGPT,本周将推 GPT - 5.2。

InfoQ
新闻资讯8

震撼全网,AlphaEvolve矩阵乘法突破被证明为真!开发者用代码证实

开发者用Claude写代码证实谷歌DeepMind的AlphaEvolve求解矩阵乘法的突破为真,它将4×4复数矩阵计算次数从49次减到48次。小哥测试代码各项指标与论文报告一致,还上传到GitHub。

新智元
8

4倍无损压缩Diffusion,6倍加速!仅需时间特征维护 | TPAMI'25

扩散模型时间特征对量化敏感,现有量化方法会致其扰动,影响图像质量。港科大等多校团队提出TFMQ - DM框架,优化时间特征相关模块,提升低比特量化性能,实现硬件加速。

新智元
算法论文8

大模型最后一层竟是推理累赘?绕开对齐税,奥数准确率暴涨 22.4%!

Qwen团队、清华和南洋理工研究打破传统认知,揭示‘对齐税’现象。提出Confident Decoding策略,在多架构和评测集实验中表现出色,开销低,挑战‘LLM最后一层最优’常识。

量子位
开源动态8

这款OCR神器绝了,PDF、表格、手写体通吃,20+文档支持,9.4K Star!

开源君在Github发现开源OCR工具Zerox,由Omni - AI团队开发,利用AI视觉模型“阅读”文档,将多种格式文档转Markdown。它功能强大,处理复杂文档优势明显,在Github获9.4K Star。

开源先锋
产品应用7

新版DeepSeek R1你得这样用,太爽啦~

前几天DeepSeek R1悄悄更新,作者测评发现,起初用复杂提示词,它比Claude4有明显差距;换成一句话提示词,生成效果质的飞跃,代码能力大幅提升接近Claude4,写作小提升,数学能力提升不大。

开源星探