「测试时间扩展」共找到 2429 篇相关文章
为MoE解绑:全新「专家即服务」推理架构发布,超细粒度扩展锐减37.5%成本
近年来大模型推理开销增长,MoE架构虽能避免计算量同比增,但带来扩展性差、容错性低、负载不均等问题。为此作者提出全新「专家即服务」推理架构EaaS,实验显示它能锐减37.5%成本。
你的AI“体检”了吗?开源AI红队测试平台,一键自查三大风险
AI圈一边是顶尖模型发布,一边是大模型被“越狱”输出有害内容。腾讯朱雀实验室开源A.I.G平台,能模拟真实攻击对AI产品全方位风险扫描,有大模型体检、基础设施漏洞扫描、MCP Server风险检测三大核心能力。
开源TTS语音新标杆!Kyutai TTS:350ms延迟碾压全场,词级时间戳重构!
法国AI实验室Kyutai开源高性能TTS语音模型Kyutai TTS,基于DSM框架,支持流式输入、超低延迟与高保真语音生成,有多项亮点,还给出不同使用方式及应用场景。
从“铁三角”到“六有”组织,北银金科如何打造千人高密度数智化团队?| 极客时间企业版
在2025 DTDS全球数智人才发展大会上,北银金科赵瑞兰介绍数智化转型实践。北银金科构建“ACT”模型,打造“六有”组织文化,开发人力看板等成果,未来愿与伙伴探索AI时代。
Dario Amodei 万字长文:我们已经没有时间可以浪费了,直面并克服强大AI带来的风险
Dario Amodei万字长文指出,最早2027年或现超诺奖得主AI,人类面临安全威胁。他定义了“强大AI”,分析自主性、滥用、经济颠覆等风险,给出多方面防御措施,强调人类要直面问题。
从OpenAI离职创业到估值1700亿美元,Anthropic用4年时间引硅谷巨头疯狂押注
最新消息,Claude背后公司Anthropic即将达成新一轮融资50亿美元,总估值达1700亿,不到半年估值涨近3倍。该公司由前OpenAI员工创立,获亚马逊、谷歌等投资,其模型在代码生成领域优势明显。
大模型能“原地”改参数了!字节Seed&北大新论文:测试时推理无需加层重训练
字节Seed和北大研究团队提出In - Place TTT方案,让大模型能“原地改参数”。它复用Transformer的MLP模块,解决现有TTT架构不兼容、计算效率低和优化目标不匹配问题,实验证明可提升模型长文本任务表现。
交互扩展时代来临:创智复旦字节重磅发布AgentGym-RL,昇腾加持,开创智能体训练新范式
强化学习之父指出人工智能迈入「经验时代」,在此背景下,复旦、创智、字节研究者发布 AgentGym - RL 框架。它是全新端到端 RL 框架,提出 ScalingInter - RL 方法,7B 模型经训练追平顶尖商业模型,为 AI 发展注入动力。
一文看懂 TritonNext 2026:FlagOS 亮点详解、语言扩展新趋势、AI 生成更加“底层”、芯片软件生态或迎“新拐点”!
1月9日,「2026 TritonNext技术大会」召开,专家探讨AI编译器等最新解法。如林咏华介绍FlagOS v1.6应对生态难题;崔慧敏用“AI for Compiler”破芯片演进难题;上海人工智能实验室推出DLCompiler打破算子开发困境等。
EMNLP25 | 北大x腾讯光子发布 C3 Benchmark:中英双语语音对话模型“地狱级”测试基准,直击语音对话模型软肋!
近年来语音对话模型受关注,但处理人类对话复杂现象的效能缺乏研究。北大联合腾讯光子构建中英双语C3 Benchmark数据集,评估模型应对复杂对话的能力,结果揭示性能瓶颈,为模型优化提供参考,代码和数据已开源。