「大模型调用」共找到 9289 篇相关文章
人才济济的大厂,为何频频产出垃圾代码?
科技大厂常产出垃圾代码,原因在于多数代码变更由菜鸟工程师完成,他们经验不足且常处于摸索状态。老手虽有优势,但过度依赖有问题。大厂为调度人才牺牲代码质量,这在AI时代隐患更大。
快手进军AI编程!“模型+工具+平台”一口气放三个大招
AI编程竞争激烈,快手发布AI编程产品矩阵进军该赛道。其“三位一体”矩阵含顶尖自研模型、智能开发工具和MaaS平台,KAT - Coder - Air轻量版免费。各产品亮点多,助力构建AI编程新生态。
Karpathy最新分享!给大模型做好“服务”将是巨大机会
近日,Karpathy在AI Startup School演讲,提出AI正从根本改变软件。他将软件分三个时代,认为LLM是全新操作系统,还指出其特长与局限,点明AI时代两大机遇:部分自主应用和构建Agent友好工具。
4·18 北京 Elastic AI Tech Day|搜索基座模型议程(含 Jina 模型与 Reader)
Jina AI 模型迭代加速,Jina Embeddings 到五代目,Reranker v3获最佳论文。4月18日 Elastic AI Tech Day 将举办,Jina 团队将做系统公开技术分享,涵盖搜索AI等多方面内容。
Meta首个Agent生图模型登场,空降竞技场第二
Meta超智能实验室推出图像生成模型Muse Image,引入智能体机制,能编写代码、网络搜索,有自主修正能力,支持算力扩展、多轮编辑与画面合成。还预览了Muse Video,两模型均与Meta产品深度整合。
突发!反噬来了,英伟达限制使用 Anthropic 模型
本文爆料突发AI行业事件:Anthropic发布新模型后推出强制数据留存政策,推翻此前和企业签订的零数据保留协议,引发数据安全担忧,英伟达等三家巨头率先限制使用其模型。
Meta新研究:字节模型蒸馏后,天花板破了
本文介绍Meta FAIR与华盛顿大学合作的最新研究,针对传统大模型蒸馏Token候选空间大、存储成本高的痛点,提出字节级蒸馏方案,验证其可突破Token天花板提升模型能力上限。
Google Gemini Embedding2:一个模型处理所有媒体类型
Google发布Gemini Embedding 2,首个原生多模态嵌入模型。能处理文本、图像等多种媒体类型,支持交错输入,覆盖超100种语言。与多模型串联方案比,延迟降70%、召回率升20%。已可在Gemini API等使用。
字节会师何恺明!开源连续扩散语言模型Cola DLM
字节会师何恺明,开源连续扩散语言模型Cola DLM,释出论文、代码等。该模型跳出离散token束缚,把生成过程交给连续空间,在实验中展现出稳定scaling趋势,其动机是表征而非diffusion。
长文本推理 5 倍提速!面壁MiniCPM4 端侧模型发布,0.5B模型效果秒杀同级
近日,面壁发布 MiniCPM4.0 端侧模型,有 8B、0.5B 两种规模。其在基准测试表现出色,长文本推理提速,缓存锐减,还做了架构创新。此外,面壁有自研推理框架,科学化建模产线,6 月 27 - 28 日 AICon 北京站将探讨 AI 趋势。