模型落地」共找到 8170 篇相关文章

产品应用7

时隔一年,再次使用7个国产AI大模型写高考作文,国产模型的进步也太大了!有彩蛋。

去年评测国产模型写高考作文能力时,各模型问题不少,如用词重复、字数不足。今年再次测试7个国产模型,能力有指数级提升,文采惊人,扣题方面通义千问和文心一言表现出色。文末还有海外模型“翻车”彩蛋。

开源AI项目落地
产品应用8

英伟达帮你省钱,让大模型推理「短而精」,速度快5倍

过去大模型推理追求长链思维,导致推理链长、Token消耗大、响应慢。英伟达研究院的DLER研究给出解决办法,通过强化学习优化方法让模型‘短而精’,推理长度减超70%且准确率不变,还适用于大模型

机器之心
开源动态8

模型推理极限在哪里?微博开源3B小模型,比肩顶级闭源

微博新开源的VibeThinker - 3B小模型,将特定能力维度性能推向极限。它在数学竞赛、编程等可验证推理基准上表现优异,成绩直逼顶尖大模型。其训练流程层层叠加,还提出参数压缩 - 覆盖假说。

AIGC开放社区
产品应用7

安全垂类小模型效果能超过大模型?看看以色列Novee的效果

跟踪AI渗透测试等开源应用发现,通用大模型成本高、功能受限。以色列Novee融资5150万美元并发布4B小模型,测试效果超Claude 4 Sonnet。其靠两阶段训练和浏览器反馈提升能力,有投资说明有价值。

AI与安全
产品应用8

都在问世界模型怎么落地,PixVerse把答案做成了「好玩」

互动式娱乐市场正在爆发,PixVerse推出实时视频世界模型R2版本。该版本让用户真正和世界交互,解决实时视频世界模型持续scaling问题,从内测case来看玩法丰富,其底层技术也有大幅改进。

机器之心
产品应用8

Agent 落地,数据库先变

AI竞争靠近落地,Agent如何读懂业务、释放模型智能价值成核心命题,数据库也被推到台前。Agent成新用户,对数据库提出新要求。OceanBase提出湖库一体架构,欲做Agent时代数据底座,降低落地成本。

AI科技评论
新闻资讯7

翁荔创业大模型首秀!告别“120亿美元估值0模型

Thinking Machines Lab发布首个模型TML - Interaction - Small,联合创始人翁荔演示。该模型让实时交互成原生能力,响应延迟比GPT - realtime - 2.0快4倍,解决了多数AI“回合制”问题,还介绍了实现机制和公司过往情况。

量子位
算法论文8

AGI真方向?谷歌证明:智能体在自研世界模型,世界模型is all You Need

谷歌DeepMind研究人员表明,通用AI智能体处理复杂长期任务需学习内部世界模型,还证明可从智能体策略提取该模型。此研究成果补充多领域,对AI发展和安全意义重大。

机器之心
产品应用8

Manus高溢价收购背后,是Agent开发落地困境

近期Meta 20亿美元收购Manus引发关注,暴露Agent开发落地难题。阿里云百炼升级“1+2+N”体系,“N”组件解决数据、安全等问题,“2”提供新开发范式,“1”深挖模型服务工程,还发布企业版助力落地

InfoQ
开源动态8

模型开发者必读!拆解世界级AI模型的诞生,Hugging Face把4年模型训练经验写成了一本开源指南

Hugging Face发布《The Smol Training Playbook》,分享约4年构建SOTA模型和数据集的经验。手册涵盖是否训练、训练何种模型、如何训练等内容,强调数据质量重要性,还介绍了模型设计、训练中的实践与教训。

AIGC开放社区