「多平台架构」共找到 6297 篇相关文章

推荐文章7

「Memory as a Context」是否将重新定义 Transformer 的 「记忆模式」?

本期机器之心PRO会员通讯解读3个AI业内要事,包括「Memory as a Context」能否重新定义Transformer记忆模式、世界模型发展情况,以及OpenRouter联合a16z发布的《State of AI》报告。详细探讨了谷歌Titans架构及其理论框架MIRAS,还提及业界对LLM记忆力的改进方案。

机器之心
产品应用7

大的来了:谷歌Gemini 3.0 Pro单次生成网页版操作系统,Win、Mac、Linux一网打尽

海外平台爆火的视频展示了用未发布的谷歌Gemini 3.0,仅靠几行提示词在2分钟内One Shot生成网页版操作系统。与Claude 4.5 Sonnet对比,Gemini 3.0优势明显,还展现出高超前端设计能力,但离真正构建操作系统仍有距离。

机器之心
推荐文章7

150%训练效率提升:感知检测小模型训练优化方法

文章基于业务实践,总结感知检测小模型在不同算力卡上的训练方法,为智能驾驶场景提供借鉴。介绍测试环境、技术架构,分析环境依赖冲突、源代码适配等问题并给出解决方法,还提及性能优化及测试结果。此外还介绍用 RAGFlow 构建私有知识问答应用。

阿里云开发者
新闻资讯7

你的扫描全能王,作价217亿冲刺港股IPO

扫描全能王母公司合合信息拟作价217亿赴港IPO,冲刺“A+H”双重上市。其C端有扫描全能王等产品,B端有TextIn等产品。合合以文本智能技术为核心,打造三大技术平台,C端靠付费订阅、B端卖产品模块盈利。

量子位
开源动态7

DeepSeek-R1今天一次「小更新」,颠覆了大模型格局,网友:尽快放R2

昨晚,DeepSeek官方宣布其R1推理模型升级到最新版本(0528),并公开模型及权重。该版本参数量高达6850亿,采用MIT许可证,性能提升明显,在多个基准测试中成绩优异,网友实测代码能力也大幅提升,但仍存在过度思考问题。

机器之心
新闻资讯8

「人类造的最后一个AI」还有多远?一张图看懂OpenAI、Anthropic等大厂的RSI进度

本文报道中国前沿AI机构Theseus Labs联合多家产学研机构发布RSI领域研究报告,梳理全球72家头部AI厂商的RSI研发进展,提出五级RSI框架与HCI指标,拆解出可工程化的RSI发展路径,发布后在海外AI圈引发热议。

机器之心
算法论文7

谈一谈TP推理场景下MoE Group GEMM的优化思路

作者在使用H20测试SGLang CUTLASS MoE时,发现其在中小Batch Size场景下性能不佳。为此设计Expert Specialization方案,启动多个不同配置Kernel,依Expert计算特性选合适的。还介绍了该方案在H20和Hx00上的实现细节及性能测试结果。

GiantPandaLLM
开源动态7

GPT-5得分不到0.4!法律+金融最大规模基准:1.9万+专家评估准则

新推出的PRBench基准可测AI在金融和法律领域表现。它有19356条专家评估准则,是该领域最大公开基准。顶尖大模型在困难子集得分低,还独创经济路径分析维度,约30%任务为多轮对话,揭示了AI在专业领域的不足。

新智元
新闻资讯8

0.027B手机AI模型,估值2亿美金,三个清华学霸如何获得国际大学生创新大赛冠军

10月15日,清华万格智能团队“基于类脑架构的下一代通用模型与智能体生态”获中国国际大学生创新大赛(2025)冠军。团队由三个清华本科生创立,此前已完成融资,估值达2亿美元。其智人HRM模型有诸多优势,还研发出顶尖气候预测专家模型。

AIGC开放社区
新闻资讯8

阿里一口气发了N款新模型,让我们向源神致敬。

阿里云栖大会发布众多模型,有Qwen3 - Max、Wan2.5等。Qwen3 - Max对标顶尖模型;Wan2.5支持音画同出;Qwen3 - VL是强大视觉语言模型且已开源;Qwen3 - Omni是全模态模型。此外还有多个新模型,构建全场景生态。

开源星探