业务理解」共找到 1325 篇相关文章

算法论文8

苹果传统强项再发力,视觉领域三种模态终于统一

苹果在大模型领域常受挫,但计算机视觉研究是其强项。其研究团队提出 ATOKEN,这是首个能在主要视觉模态统一处理的分词器,兼顾重建质量与语义理解,成果朝通用视觉表征迈进一步。

机器之心
新闻资讯7

成都中专生,干出3500亿

AI东风下,新易盛靠光模块业务半年暴赚40亿,市值超3500亿。其掌舵者高光荣中专出身,近40岁创业。新易盛产能达历史高峰,机构看多助推估值飙升,同行也在风口起飞。

芯师爷
开源动态8

社区供稿 | 开源SOTA:阶跃发布端到端语音大模型Step-Audio 2 mini!

阶跃星辰发布最强开源端到端语音大模型 Step - Audio 2 mini,在多个国际基准测试集获 SOTA 成绩。它统一建模语音理解等,率先支持语音原生 Tool Calling 能力,架构创新,案例展示其多方面强大能力。

Hugging Face
新闻资讯7

比 996 还狠!让面试者8小时复刻出自家Devin,创始人直言:受不了高强度就别来

Cognition 公司面试要求面试者 8 小时复刻自家 Devin,其 CEO Scott Wu 直言受不了高强度就别来。文章还介绍了他的成长经历、创业看法,以及 Devin 特点、业务指标、未来格局等,也提及收购 Windsurf 事宜。

AI前线
算法论文8

KDD 2025 | UoMo来了,首个无线网络流量预测模型,一个框架搞定三类任务

在 ACM KDD 2025 大会上,清华与中国移动联合发布 UoMo,全球首个面向移动网络的通用流量预测模型。它结合扩散模型与 Transformer,能理解地理与人流变化,一个框架搞定三类流量预测任务。

机器之心
开源动态8

GLM4.5之后,智谱又开源GLM-4.5V,实测下来视觉推理能力贼强~

智谱继GLM4.5后又开源GLM - 4.5V,它是同级别开源SOTA视觉推理模型,在多模态理解榜单表现优异。文章实测其在科研全生命周期的应用,还介绍了模型架构设计和训练策略。

PaperAgent
开源动态8

是「福尔摩斯」,也是「列文虎克」,智谱把OpenAI藏着掖着的视觉推理能力开源了

智谱开源视觉推理模型 GLM-4.5V,还同步开源桌面助手应用。此模型视觉推理能力强,在图像识别、视频理解、前端复刻、图表处理等多方面表现出色,技术创新使其达开源 SOTA 水平,推动行业注重实用价值。

机器之心
产品应用8

Qwen3-Embedding 全揭秘:从技术到服务,打造高效AI产品的关键路径

文章全面揭秘 Qwen3-Embedding,介绍其核心原理、优势、应用场景。还给出在 PAI 和百炼平台的使用方法,含部署、推理、微调等。通过对比实验,凸显其低延迟、低成本特点,未来将成语义理解核心设施。

阿里云开发者
推荐文章7

CUTLASS CuTe GEMM细节分析(二)——TiledCopy与cp.async

文章深入分析TiledCopy,从参数理解、访存连续性等角度展开。介绍Tiler_MN和TiledLayout_TV意义及构造,指出访存连续性影响性能,还说明了基于cp.async构造TiledCopy的要点,如ValLayout选择和Layout限制。

GiantPandaLLM
新闻资讯8

马斯克发布“地球最强AI模型”Grok 4:横扫所有榜单,在“人类最终测试”超越人类博士”!

北京时间7月10日,马斯克团队发布Grok 4,其基准测试成绩惊人,在‘人类最终测试’等表现出色。它成功源于多智能体协作、追求真相哲学和高算力投入,还在多领域展现应用潜力,同时公布定价并坦言短板。

AI科技大本营