企业大模型」共找到 9898 篇相关文章

算法论文8

美团LongCat扎扎实实做了件难事:LLM数学新天花板AMO-Bench

美团LongCat团队联合高校推出AMO - Bench,用50道原创奥赛级难题评估LLM数学能力。它解决现有基准测试痛点,经四重把关构建,测试显示顶级模型表现不佳,也揭示模型提升空间

PaperAgent
新闻资讯7

AI 项目总踩坑?小团队、渐进研讨带你找到正确打开方式

Cloud Native Summit 2025奥克兰会探讨企业借Open Practice Library将协作模式转化成果。Andrea Magnorsky分享Byte - Sized Architecture方法,Ahilan Ponnusamy与Andreas Grabner介绍企业采用AI的迭代式框架,强调小规模持续研讨。

InfoQ
产品应用8

88天登录193次!顶级证据+循证医学,让500万中国医生拥有「神助攻」

国内医生面临高负荷工作与医学知识快速更新的挑战,通用模型在医学场景中存在高幻觉率问题。阿里健康推出医学AI产品「氢离子」,具备低幻觉、高循证特点,有四层循证架构,还与多方合作构建数据壁垒。

机器之心
产品应用7

如果你还不知道龙虾是什么,可以先试试 MaxClaw

去年开源模型 DeepSeek R1 火爆,今年个人 AI 助手 OpenClaw 成焦点。OpenClaw 在 GitHub 获量 Star,MiniMax 基于它推出的 MaxClaw 是云端 AI 助手,功能多、易使用,在个人和企业场景都有作用。

MacTalk
新闻资讯8

哇塞,今天北京被机器人人人人人塞满了!

世界机器人会在北京开幕,100多个新机器人亮相。智平方的爱宝机器人人气爆棚,它能用一个基座模型完成多任务。其搭载的GOVLA模型有四核心能力,且已在多行业商业化落地。

量子位
新闻资讯7

曦望,死磕AI推理成本|甲子光年

1月27日,国产GPU厂商曦望发布新一代推理GPU芯片启望S3等。启望S3面向模型推理定制,设计系统级重构,单位Token推理成本降约90%。曦望还推出超节点方案及推理云计划,目标是极致推理性价比。

甲子光年
开源动态7

Codex+hyperframe做视频,让剪辑师们慌了?

开源项目Hyperframes刷屏,它是基于HTML的视频渲染框架,不用视频模型,用普通语言模型就能生成可控视频。它与Remotion有区别,选了对AI友好的路,还介绍了安装、使用方法和适用场景。

鲸选AI
新闻资讯8

OpenAI 3万亿美元测试,AI首战44个行业人类专家!

OpenAI推出GDPval评估体系,通过真实工作任务审视模型潜力,揭示AI从实验室走向3万亿经济战场的可能。早期测试显示,Claude Opus 4.1表现最佳,GPT系列进步快,模型在部分任务逼近人类专家水平。

新智元
产品应用8

阿里发了个简历AI神器,小仅0.6B

阿里巴巴集团研究团队开发出基于布局感知的简历解析框架,在简历解析任务准确率逼近Claude - 4等顶尖模型,处理仅需1 - 2秒,直击自动化简历解析痛点,已在阿里HR系统全面部署。

量子位
产品应用8

国产AI首次「长出」原生记忆,非Transformer架构成新王!机器狗当场引爆WAIC

WAIC世界人工智能会上,国产黑马RockAI的模型Yan 2.0 Preview亮相,可多终端无损部署。它基于非Transformer架构,训练效率高,有原生记忆,实现端侧AI,展现出自主学习和多模态能力,引发关注。

新智元