测试时扩展」共找到 2645 篇相关文章

算法论文8

Dense、MoE之外第三条Scaling路径:交大提出JTok模块,省1/3算力

上海交通大学与小红书Hi Lab联合团队提出JTok/JTok - M模块,作为插件挂载在Transformer层,几乎不增算力和显存开销却显著提升性能。该模块构建新scaling路径,在多任务测试中全面提分,为大模型发展提供新方向。

机器之心
新闻资讯8

The Batch: 885 | Claude 升级了

Anthropic更新中型模型Claude Sonnet至4.5版本,在性能上显著提升,还引入可变推理token预算。Claude Code智能编码工具也获功能增强,新增Claude Agent SDK等。测试中Claude Sonnet 4.5表现优异,Anthropic重心转向编码与职场生产力。

DeeplearningAI
算法论文8

LLM驱动的威胁情报提取框架,从非结构化到STIX的自动化:IntelEX

为应对网络攻击,需将非结构化网络威胁情报转化为结构化情报。IntelEX是自动化攻击级威胁情报提取工具,通过LLM上下文学习等增强,能识别攻击序列并提取结构化情报为STIX格式,还可转化成Sigma,在测试中表现优异。

AI与安全
开源动态8

英伟达开源9B参数小模型,比Qwen3快6倍

英伟达推出新型小型语言模型Nemotron Nano v2,在复杂推理基准测试上准确率与Qwen3 - 8B相当或更高,速度快6倍。它兼顾推理与非推理任务,支持“思考”预算控制,还开源了创建模型的绝大部分数据。

量子位
推荐文章7

“老程序员”为啥不迷信 AI 带来的效率提升?聊聊 AI 编码的局限与现实

开发经验丰富的人对AI编码提升效率更保守,因现有开发模式下,AI编程效率提升有限。特定场景AI给力,但项目复杂提升迅速下降,还分析了原因,最后提到微服务架构或在AI编程代重新火起来。

宝玉AI
新闻资讯7

「注意力经济」下,AI 生活助手能否解锁生服「新」刚需?

今年不少国内大厂加码AI生活助手赛道。腾讯、阿里、美团、京东、滴滴等各有动作,如腾讯在微信上线「元宝」,阿里在电商业务开发助手。当前AI应用使用长和留存率不佳,而助手或能过滤信息、缩短决策链路。

机器之心
开源动态8

通过零开销逐层权重卸载技术将SGLang Diffusion wan2.2的推理速度加速60%

文章介绍在优化SGLang对Wan2.2视频生成模型支持,发现双Transformer架构下第1步和第19步推理慢的问题。通过零开销逐层权重卸载技术,将整体推理速度提升60%,还突破显存墙,且该优化可扩展到其他模型。

GiantPandaLLM
产品应用8

从网页截图到精准复刻只需30秒:这个新模型刷新了我的认知

智谱AI发布GLM - 4.6V系列模型,是首个支持工具调用的视觉模型。作者对其进行7个场景测试,如识别鸟类、分析赶海地点等,展现出不错性能。该模型速度快、开源,有优势也有小问题,适合开发者和普通用户。

花叔
7

OpenAI 广告续命遭全网骂,用户要跑路Gemini!需烧 400 亿,18个月破产预警

OpenAI计划在ChatGPT对话界面向美区免费版和低价订阅用户测试广告投放,旨在拓展营收缓解成本压力。此举动引发批评,用户转向Gemini。OpenAI虽营收增长,但算力投入大,首席财务官称加广告会坚守三大原则。不过,有预测称其18个月内或破产。

AI前线
开源动态8

纯血国产!4B模型越级打怪,杀入万亿赛道

9月1日,Hugging Face上线星火X2.5-4B和1.7B开源端侧模型,在多指标测试中表现优异,实现“越级打怪”。该模型基于全国产算力平台训练,在断网笔记本上实测效果惊艳,使用了两项技术提升能力,适配性强。

新智元