GPT-2」共找到 2698 篇相关文章

新闻资讯8

人均「95后」,账上超十亿美金,MiniMax叩响港股大门

国内AI创业公司MiniMax在港交所刊发招股书,上市进入冲刺阶段。它以全模态技术和产品服务全球用户,营收增长快、亏损收窄,M2模型表现亮眼,且团队年轻高效,此次上市意义非凡。

机器之心
开源动态8

HAMi × NVIDIA:GPU 拓扑感知调度实现详解

HAMi社区在v2.7.0版本推出针对NVIDIA GPU的拓扑感知调度功能,解决多卡通信瓶颈。文章深入剖析其设计与实现原理,介绍核心特性、阶段及代码,用双策略寻优算法保障性能与资源健康。

AI前线
新闻资讯7

用AI,写代码只会更慢!但一定更「快乐」

METR研究实测发现,GPT等AI编程工具让顶尖程序员写代码平均慢19%,效率不升反降。开发者本预计提效24%,体验后仍觉快20%。研究还分析变慢原因,提醒勿高估AI编程能力。

新智元
新闻资讯7

腾讯混元挖走微软明星大模型团队!一作全员出走,新成果已跻身大模型竞技场TOP 10

微软明星大模型WizardLM一作全员加入腾讯混元,最新成果Hunyuan - Turbos跻身大模型竞技场TOP 10。此前WizardLM - 2发布不顺,且微软将裁员超6000人,国内大厂正激烈争夺大模型人才。

量子位
产品应用7

Claude Sonnet 5:更强,但更贵,每任务成本反超Opus 4.8

Anthropic 发布的 Claude Sonnet 5 智能指数追平 GPT - 5.5,但每任务成本比 Opus 4.8 贵 15%。它在知识工作类任务表现佳,推出促销价,不过促销后成本待察。评估迁移时需算 token 消耗。

AI工程化
算法论文8

开放世界任务成功率82%!美的攻克机器人泛化控制难题

美的AI研究院和华东师范大学联合提出ChatVLA - 2模型,引入动态混合专家架构和双阶段训练流程。真机实验显示其开放世界任务成功率达82%,远超现有方法,为通用机器人控制提供新思路。

量子位
产品应用7

太牛了~~复杂表格Cell合并、跨页拼接,中文领域96%,甩MonkeyOCR 20%

在PDF文档解析领域,复杂表格解析是难题。今天分享的OCRFlux是基于qwen2.5vl - 3B模型微调的解决方案,有单页解析和跨页段落/表格合并等创新点,测试得分超96%,远超MonkeyOCR等。

PaperAgent
开源动态8

伯克利最强代码Agent屠榜SWE-Bench!用Scaling RL打造,配方全公开

开源软件工程模型DeepSWE横空出世,基于Qwen3 - 32B,仅用强化学习训练,以59%准确率刷新SOTA。它采用rLLM框架、R2E - Gym环境,用改良GRPO++算法,还介绍了评估策略及训练挑战的解决办法。

新智元
产品应用7

实测updream预演台:一张图,换来一整个3D片场!

作者实测updream预演台,它可传图自动重建3D白模场景,可摆人物、调机位等,再配合Seedance 2.5渲染成片。作者还做了对照实验,证明白模能锁定拍摄意图,并给出使用建议。

花叔
产品应用8

世界最强医疗模型百川M3发布:AI医疗,奇点已至

百川智能发布并开源全球最强医疗模型Baichuan - M3,各项指标SOTA且超越人类医生平均水平。它告别机械‘背医书’,学会主动追问、排查病因,解决AI‘胡说八道’问题,准确度超GPT - 5.2 - High。

新智元