FP8精度」共找到 755 篇相关文章

算法论文8

POF | 上海理工大学梁梓浩、朱兵等:使用大语言模型进行气泡湍流实验数据处理

本文提出结合大语言模型(Time - LLM)与Transformer模型的复合框架处理气泡两相流热膜测量信号干扰。先由Time - LLM识别气泡干扰信号,再用Transformer模型修复。实验证明该方法高效、轻量且物理自洽。

力学与人工智能
产品应用7

Cursor发布Composer 2:专攻代码的模型,价格只有GPT-5的零头

Cursor本周发布自研编程模型Composer 2,只攻代码生成。其得分提升,超Claude Opus 4.6,接近GPT - 5.4 Thinking。训练基于代码数据,处理复杂编程任务准确度高,价格远低于竞品。这是Cursor全栈布局,欲掌握AI编程主动权。

AI工程化
新闻资讯7

谷歌曾说“不是秘密”的东西,Gemini时代成了提款机:三人创业团队48小时濒临破产

墨西哥一家三人初创公司的 Google Cloud API 密钥被盗用,48 小时产生 82314.44 美元费用,谷歌以‘共享责任模式’为由让客户承担。研究员指出谷歌 API 密钥存在权限提升等问题,此事件引发广泛讨论。

InfoQ
开源动态8

中心动态重分配哈希,北邮团队提出并开源CRH项目 | AAAI 2026

北京邮电大学等机构联合提出新颖端到端框架 CRH,在训练哈希函数时动态更新哈希中心,提升检索精度和语义一致性。论文被 AAAI 2026 收录,代码已开源。

AI前线
开源动态7

被DeepSeek带火的OCR,最新8个开源模型盘点~

DeepSeek-OCR发布让OCR大热,PaperAgent梳理盘点8个热门开源OCR模型,如DeepSeek-OCR用‘上下文光学压缩’技术,Nanonets-OCR2-3B以零样本视觉链式思维为核心等。

PaperAgent
开源动态8

最新W4A4KV4全量化框架,单卡A100大模型推理速度飙升

计算所王颖研究员团队等联合在ASPLOS 2025上发表并开源COMET框架,通过系统 - 算法协同优化,实现全4比特推理性能突破,在多方面有技术亮点,实测性能碾压现有方案且已开源。

AIGC开放社区
产品应用8

1000+页PDF解析速度暴涨3倍,MinerU模式不香了

百度PaddleOCR推出HPD - Parsing小模型,文档解析速度大幅提升,是上一代最快模型的1.62倍、自身原解码方式的3.06倍。它采用层级并行解码架构,有两层并行设计,效果出色且兼容性好,还分享了优质训练方法和优化思路。

CourseAI
新闻资讯8

突发,Claude首破黎曼猜想新纪录!

Anthropic让内部研究版Claude证明「黎曼猜想」失败,但它将符合猜想的黎曼Zeta函数零点比例下限从41.6%提升到67.2%。此成果意义重大,标志AI进入开放数学研究。

新智元
算法论文8

视听分离SOTA提速6倍!清华发布首个6M高性能模型|ICLR'26

清华大学团队推出Dolphin模型,仅用6M参数,通过离散化视觉编码和热扩散注意力机制,实现单次推理精准分离语音,速度提升6倍以上,在多项基准测试中刷新纪录,为端侧设备部署开辟新路。

新智元
新闻资讯8

智谱定档大模型第一股,1月8日挂牌上市,IPO预募资43亿港元

智谱定档2026年1月8日在港交所主板挂牌上市,预募资43亿港元,上市后市值预计超511亿港元。它是中国最早开展LLM研发的公司,多模型表现亮眼,靠MaaS模式实现盈利,但研发投入巨大。

量子位