长序列」共找到 684 篇相关文章

开源动态8

SGLang Hierarchical Sparse Attention 技术深度解析

阿里云等团队推出面向 Sparse Attention 的分层稀疏化框架,介绍其架构、机制与实践。此框架破解了上下文推理时的计算与容量瓶颈,以 DeepSeek DSA 集成测试,使推理性能大幅提升,目前项目处于开发阶段。

阿里云开发者
新闻资讯8

Meta数十亿美元收购Manus背后:从江西小镇到硅谷风暴眼,肖弘的十年狂飙

本文讲述了肖弘的创业历程,从江西小镇少年成为Meta副总裁。他经历多次创业起伏,如早期项目失败,后借壹伴、微伴等产品成功。2022 年起投身 AI,开发的 Monica、Manus 成绩斐然,最终 Manus 被 Meta 数十亿收购。

花叔
算法论文8

腾讯发布大模型思考早停算法SpecExit,效果无损,端到端加速2.5倍!

腾讯为破解大模型思维链效率难题,提出思考早停算法SpecExit,将思考早停与投机采样融合,在不影响准确性前提下,在vLLM上实现端到端加速2.5倍,还能缩短思维链度。

腾讯技术工程
开源动态8

DeepSeek重磅开源3B OCR模型,一天处理20万页文档!一天内斩获6K标星!

DeepSeek开源3B OCR模型DeepSeek - OCR,参数量仅30亿,单张A100 - 40G一天能处理20万页文档,不到24小时获6K标星。它是视觉压缩引擎,解决大模型处理文本算力爆炸问题,有诸多技术亮点。

开源星探
新闻资讯8

资本视角下的智造落地战:五位投资人划定关键赛道与投资红线|甲子引力X

在「2025甲子引力X中国科技产业投资大会」上,五位投资人共议智能制造。他们认为当前制造业面临降本增效等挑战,投资时“团队”是关键,中国智能制造在多领域有成空间,创业者要内修能力、外抓需求。

甲子光年
新闻资讯8

OpenAI首个蛋白质模型披露更多细节,改进诺奖研究成果,表达量提升50倍

OpenAI与Retro Bio合作开发的GPT‑4b micro,是专为蛋白质工程设计的GPT-4o微型版本。它改进诺奖获奖蛋白变体,将干细胞重编程标记物表达量提升50倍,还能减少DNA损伤,研究团队公布更多突破细节。

量子位
新闻资讯7

月烧35万元token、逼得Claude官方连夜限速!被全网吐槽的中国“榜一大哥”,已经靠 AI 年入千万了

X用户“刘小排”认领30天按200美元计划消耗5万美元Claude Code token一事。他靠AI年入近千万,用Claude Code做产品,回应网友质疑,称在规则内使用,还分享创业经验,认为AI是期机会。

AI前线
开源动态8

字节Seed开源线记忆多模态Agent,像人一样能听会看

字节Seed发布全新多模态智能体框架M3 - Agent,能听会看、有期记忆且免费开源。团队还开发新视频问答基准M3 - Bench并开源。实验显示,M3 - Agent在多基准测试中显著优于基线模型。

量子位
推荐文章8

一年上线超 10 款产品,AI 时代如何做独立开发

ThinkAny&MCP.so 创始人艾逗笔分享独立开发感悟与经验。他一年半做了十来款 AI 产品,认为开发要快,也需期主义。还给出 AI 应用出海经验,介绍可 all - in 的 AI 创业方向,如 AI Coding、Agent 等。

InfoQ
产品应用8

Qwen3.7:智能体新前沿

阿里云正式发布面向智能体时代的Qwen3.7-Max模型,将通过API提供服务。它能力全面,编程、办公、周期执行等表现出色,适配多框架,在多场景评测中领先,能驱动生产力跃升,还经多实战测试验证实力。

千问大模型