「OpenAI 兼容模型」共找到 8966 篇相关文章

新闻资讯7

警惕全球“最大”芯片IPO的暴雷风险

Cerebras 5月14日上市成2026年迄今全球最大IPO。其核心产品WSE工程有突破,但良率计算方式与传统不同。训练未成功,推理找到新机会。与OpenAI超200亿美元合同背后是股权换订单,财务数据也有隐忧,上市后存诸多疑问。

芯师爷
新闻资讯8

MiniMax今早上市,股价疯涨80%!一群95后跑通了中国AI的价值

1月9日9:30,MiniMax于港交所上市,截稿时股价疯涨近80%。该公司仅用约5亿美元便让全模态模型进入国际第一梯队,员工平均年龄29岁。其以低投入、高产出及全球化业务,展现了中国AI的实力与潜力。

新智元
推荐文章8

Sam亲自泼冷水,GPT-5意外失手:我们对AI的期待,是否已被整个行业误判?

科技行业集体转向 AI,高管强调其变革性,可 OpenAI 的 Sam Altman 却泼冷水,提醒投资者高估回报。文中围绕‘AI 是否放缓’展开讨论,还分析了 GPT - 5 发布遇冷原因、AI 对就业影响等,指出 AI 发展多且快,未来潜力巨大。

InfoQ
算法论文8

EMNLP 2025 | T2R-bench: 业内「首个」工业级表格生成报告评测基准

中国电信人工智能研究院推出业内首个面向真实工业场景的“表格到报告”基准T2R-bench,涵盖多领域真实表格、问题与人工标注关键点,配套创新性三维度评测体系。实验显示主流大模型在该任务上表现欠佳,提升空间大。

AINLPer
新闻资讯7

具身智能迎来“安卓时刻”,一位清华博士决定给机器人换脑|甲子光年

千诀科技CEO高海川讲述其打造的具身智能系统,可脱离特定硬件载体,安装到不同机器人。公司跳出端到端VLA束缚,选分区预测式世界模型,目标是打造“机器人领域的安卓系统”,还认为家庭场景比工业场景易落地。

甲子光年
开源动态7

从一行代码发现DeepSeek的秘密:Model1到底是什么?

在DeepSeek - R1发布一周年时,有人在GitHub的FlashMLA代码仓库发现神秘代号Model1,可能是V4。文章分析了代码仓库用途、新模型“露馅”原因,还从代码中发现Model1细节,结合论文梳理时间线,最后也提出了怀疑。

花叔
产品应用7

“导演梦”不再遥远:Captain Cinema 让你用短片制作出电影

约翰·霍普金斯大学与字节Seed团队推出自动生成短片的Captain Cinema系统。它以剧情文字为输入,先规划关键帧,再补全画面动态合成短片。采用特殊训练法和模型,虽有局限,但为电影自动生成迈关键一步。

带你学AI
推荐文章8

5Y View|Bill Gurley:AI浪潮如何重塑一级市场结构

知名风投大佬Bill Gurley指出,超级风投基金崛起催生“僵尸独角兽”,零利率使IPO和并购停滞,LP面临流动性问题。AI浪潮打断市场修正,带来投资热潮和估值泡沫,多数AI企业营收靠算力转售。他还看好中国开源AI模型发展。

五源资本 5Y Capital
新闻资讯8

专治Demo玩家:「具身灵巧操作奥林匹克」大赛三项第一,全被国内这家公司拿下

星动纪元凭借自研VLA具身智能模型,在具身界灵巧操作奥林匹克Benjie's Olympics大赛中,于翻袜子(银牌难度)、开锁和剥橘子(金牌难度)三项任务上击败技术领先者PI,拿下全球第一,展现全栈技术优势。

机器之心
算法论文8

Make SFT Great Again!从SFT到DFT:一权重之差,泛化之跃

大型语言模型的监督微调(SFT)简单高效,但泛化能力弱于强化学习(RL)。本文直击 SFT 核心缺陷,揭示其泛化瓶颈源于隐含的“病态奖励结构”,并提出仅需单行代码修改的动态微调(DFT),实验表明其效果显著。

深度学习自然语言处理