成本性能」共找到 6932 篇相关文章

开源动态8

字节Seed新方法!开源8B代码模型:自己筛数据训练自己,同量级SoTA,还超越百亿级对手

传统code大模型依赖人工筛选数据,本高、效率低。而Seed - Coder团队让LLM自己筛选数据训练自己,打造8B参数轻量级开源代码模型,性超百亿级对手,不过也存在通用和数学力短板。

深度学习自然语言处理
算法论文8

首创像素空间推理,7B模型领先GPT-4o,让VLM像人类一样「眼脑并用」

当前主流视觉语言模型(VLM)依赖文本token间接翻译视觉信息,缺乏直接视觉操作力。滑铁卢大学等团队提出「像素空间推理」范式,让VLM像人类一样「眼脑并用」,在四大视觉推理基准测试中,7B的Pixel - Reasoner表现碾压GPT - 4o等。

量子位
算法论文8

ICLR 2026 oral | AI代码真进生产环境?SwingArena:从「写对代码Commit」到「通过CI审查」

过去一年大模型写代码力提升,人们思考其否参与软件工程核心流程。现有评测基准有缺失,SwingArena填补空白,将博弈引入评测,设计检索增强流水线,其开源后或评估AI编程力新工具。

机器之心
开源动态8

AI杀入美股,DeepSeek又是第一!港大90后开源,AI股神人人都

在港大「AI - Trader」项目中,DeepSeek以9.68%收益率击败GPT、Claude等顶级模型,在美股自主盈利的AI交易系统。项目开源,还暴露出AI不同「性格」,显示市场是AI终极试金石。

新智元
新闻资讯8

AI也当情感大师?腾讯发布最新AI社交智榜单,最新版GPT-4o拿下第一

腾讯混元AI数字人团队打造SAGE自动化评估框架,可评价AI“共情力”与“知心伴侣”。研究团队用其对18个主流模型测评,GPT - 4o表现最佳,还通过多实验分析模型特性。

量子位
开源动态8

30.9K Star牛啊!!再见了PD,不越狱也装,支持几十种系统,苹果全设备通用!

在苹果生态运行其他系统,Parallels Desktop 收费且移动设备难装。开源工具 UTM 免费,基于 QEMU 构建,支持多架构和系统,操作界面简洁,外围设备支持强,苹果全设备通用。

开源先锋
新闻资讯7

Meta 系 95 后华人明星团队,创业一年就与高通达合作,让手机拥有多模态记忆

由华人创业者沈俊潇创办的 Memories.ai 发布 LVMM 2.0 并宣布与高通合作,该模型 2026 年将在高通处理器上原生运行。它解决视频可搜索性问题,应用广泛,降低延迟、确保数据安全等。

Founder Park
开源动态8

高手&科学明星,上海AI实验室开源发布『书生』科学多模态大模型Intern-S1 | WAIC 2025

7月26日,上海AI实验室在WAIC 2025上发布并开源『书生』科学多模态大模型Intern-S1。它首创‘跨模态科学解析引擎’,在多学科专业任务基准上超越顶尖闭源模型,还具备体系化技术创新。未来将持续开源,打造更懂科学的AI助手。

GiantPandaLLM
新闻资讯8

从MiniMax到DeepSeek:为何头部大模型都在押注「交错思维」?

昨日推特博主公布国内几大开源模型在 mini - SWE - agent 测试绩,MiniMax 新一代大模型 M2 表现最佳。其采用的「交错思维」技术亮点,解决了状态漂移问题,正高性 Agent 模型标配。M2 既强又省,还给出使用最佳实践。

机器之心
新闻资讯8

张一甲:2025人工智产业30条判断 | 甲子光年

甲子光年创始人张一甲在「2025甲子引力年终盛典」发布《轰然势 万象归一:2025人工智产业30条判断》报告。报告指出AI已“轰然势”,进入“默认式AI”时代,还从技术、产品、产业、社会等方面给出30条判断。

甲子光年