00后」共找到 1935 篇相关文章

8

企业落地 NL2SQL,需要的是 AI-ready data 和 小模型

当NL2SQL从Demo走向生产,关键是‘更干净的数据底座 + 更小的专用模型 + 更可控的工程化流程’。文章指出先数据模型,小模型足够用且落地成本低,评估要换维度,还介绍了工程化路径等内容。

InfoQ
新闻资讯7

DeepSeek刚提到FP8,英伟达就把FP4精度推向预训练,更快、更便宜

DeepSeek提及针对国产芯片的FP8量化设计,引发对大模型量化策略关注。不久英伟达发力低精度量化,将NVFP4策略拓展到预训练阶段,其方案能解决核心挑战,实验证明NVFP4在大规模训练中可行。

机器之心
开源动态8

本周推荐的5个超级6的Github开源项目!

文章推荐了5个超棒的Github开源项目。有轻量全能、自带阅即焚的pastebin工具microbin;容器与K8s管理利器Podman Desktop;开源投屏神器Escrcpy;强大易用的国产建站工具Halo;跨平台AI笔记神器NoteGen。

开源先锋
开源动态8

GLM4.5之,智谱又开源GLM-4.5V,实测下来视觉推理能力贼强~

智谱继GLM-4.1V-9B-Thinking、GLM-4.5,又开源最强多模态推理模型GLM-4.5V,在多模态理解榜单达开源SOTA。它视觉推理强,经测试能助力科研各阶段,还介绍了其架构设计与训练策略。

CourseAI
产品应用8

秘塔AI也终于悄悄上线了DeepResearch。

秘塔AI搜索上线新功能DeepResearch,作者测试评价颇高。它有可视化界面,能展示思考执行过程,打破AI黑盒。输出报告质量好、精准度高,还可生成互动网页,且免费额度多,虽有小问题但仍值得肯定。

数字生命卡兹克
新闻资讯8

微软刚发布Mu模型:支持Windows智能体,小参数跑出10倍性能

今天凌晨微软发布创新小参数模型Mu,3.3亿参数性能比肩Phi - 3.5 - mini,体量小10倍,离线NPU笔记本每秒超100 tokens响应。它支持Windows智能体,架构有多项创新,经训练优化智能体表现出色。

AIGC开放社区
新闻资讯7

AI收入暴涨!英伟达超过苹果,成为全球市值第二

根据CompaniesMarketCap数据,英伟达公布财报股价升超4%,一度成全球市值第一。截至5月29日收盘,其市值超苹果,仅比微软少150亿美元。虽此前受DeepSeek冲击,但Q1营收、利润仍创新高,二季度预计乐观。

AIGC开放社区
开源动态8

一键式训练端到端Agent,Qwen3+MCP工具集高效集成!

RLFactory是开源的端到端RL训练框架,将环境与训练解耦,用Qwen3基座调用MCP工具集,可低代码训练端到端Agent模型。它极致易用、训练高效,还支持一键式训练,未来会更易用高效。

深度学习自然语言处理
算法论文7

苹果提出原生多模态Scaling Law!早融合+MoE,性能飙升秘密武器

如今打造强大多模态模型是AI重要目标,常用方法有局限。法国索邦大学、苹果研究人员开展原生多模态Scaling Laws研究,对比早融合与融合,探讨多种因素对模型性能影响,发现早融合、多模态MoE优势,为续研究指明方向。

新智元
产品应用7

Fable 5.1 官方提示词指南

Anthropic 发布 Fable 5.1 ,同步发布《Prompting Claude Fable 5.1》提示词指南,列出 15 个 5.1 跟 Fable 5 在行为上的差异,并附修正提示词。还介绍了 Fable 5 提示词变化,以及 Fable 5.1 的新特性和应对建议。

AGI Hunt