云小二Aivis」共找到 1458 篇相关文章

产品应用8

阿里Qwen3.5模型发布:0.8B参数就能处理视频,边缘AI时代真的来了

阿里通义千问发布Qwen3.5系列四款模型,采用Gated DeltaNet混合注意力机制。有原生多模态设计,解决“内存墙”问题。在多基准测试中表现出色,开发者反响好,但也存在幻觉级联、调试局限等问题。

AI工程化
开源动态7

红书发布 SWE-Bench Mobile:当 AI Agent 面对亿级用户 App 代码库,最高通过率仅12%?

红书联合多科研机构发布 SWE-Bench Mobile,它是首个还原‘端到端’开发流程的基准,以红书 App 实际任务为核心。评测显示,AI Agent 在移动端开发能力上限低,架构设计比模型本身重要,简单提示策略效果更好。

InfoQ
开源动态8

全新OCR将图片变代码无损重绘!华中科大&红书发布3B模型,图形重建超越Gemini 3 Pro

华中科技大学与红书联合推出MOCR,提出「解析一切」新范式,将文档图形升级为「一等解析目标」。它解决传统OCR短板,在文档解析和图形重建表现出色,还革新评估方法,代码和模型已开源。

量子位
算法论文8

模型用不好Skill?新范式让模型学会Skill的底层逻辑,3B模型推理token省5倍,性能反超

浙江大学联合美团龙猫团队、清华大学推出SKILL0,提出技能内化思路。它在训练中引入关键机制,让模型把技能内化到参数里。实验显示,其效果出色,token效率高,为模型成领域专家提供新方向。

量子位
新闻资讯7

曝GPT-5.5用上「全球最快芯片」,Claude慌了!

新智元报道,OpenAI的GPT - 5.3 - Codex - Spark用Cerebras的WSE - 3芯片达2000 token/秒。Cerebras CFO称在跑GPT - 5.4和GPT - 5.5,但SemiAnalysis报告指出其跑大模型有短板,且公开模型、上下文短。

新智元
推荐文章7

Agent 开发,迎来「AI 原生」时刻

大模型时代,交互主体变为 Agent,「AI 原生」应运而生。它围绕 Agent 重构架构,有全新技术栈。基于火山引擎工具和模型,展示了 Agent 开发的新流程,还做了两个应用案例。

特工宇宙
开源动态8

社区供稿丨以博大!Nanbeige4-3B重磅开源:硬刚Qwen3,挑战模型能力新高度

近年来大语言模型发展陷入‘参数军备竞赛’,成本高昂。Boss直聘南北阁实验室发布Nanbeige4 - 3B,仅30亿参数,在预训练和后训练阶段采用多种创新技术,在多方面媲美甚至超越大模型。

Hugging Face
产品应用8

传统还在「卖铁」,下一代已在「炼钢」:火山引擎xLLM如何一张卡榨出两张的性能!

大模型上线部署时推理成本高、算力投入大但效果不成正比,企业面临推理效率难题。火山引擎 xLLM 大语言模型推理框架性能极致,成本低,集成关键创新,还被集成到 AI 原生推理套件 ServingKit 中。

机器之心
产品应用7

本地/电脑双模式,豆包来了!

黄叔实测豆包「工作任务」模式,其有独特的本地/电脑双模式。本地能分析电脑内存问题,端可处理监控任务,还能助力开发复杂项目,且Skill自动接入,与本地电脑实时同步。

AI产品黄叔
推荐文章7

目标检测难点分析和解决策略

文章基于24年综述论文,分析目标检测难点,如特征不足、难区分背景等,还给出主流改进方法,涉及数据增强、特征提取、特征融合、损失函数、训练策略等方面,介绍多种算法及效果。

机器学习AI算法工程