Qwen 3.8 27B」共找到 3028 篇相关文章

算法论文8

微软再放LLM量化大招!原生4bit量化,成本暴减,性能几乎0损失

微软公布BitNet v2,性能几乎0损失,占用内存和计算成本显著降低。它首次实现对1比特LLMs的原生4比特激活值量化,通过H - BitLinear模块处理异常通道,实验显示其在多方面表现优异。

新智元
产品应用7

变天了!WindSurf推出workflow功能,低代码大模型应用开发平台将面对“降维”打击

Windsurf在1.8.2版本推出workflow功能,其采用自然语言定义工作流并与开发IDE深度集成,是更高级形态。该功能特性丰富、应用场景多,对Dify等应用编排工具或造成‘降维打击’。

AI工程化
算法论文9

Action Map Policy:从高维动作回归到像素分类,一种新的机器人操作学习范式

本文介绍美国东北大学博士生黄浩杰提出的全新机器人操作学习范式Action Map Policy(AMP),将高维三维机器人动作转化为二维图像空间的像素分类问题,性能和推理速度均显著优于现有主流基线方法。

机器之心
新闻资讯8

张益唐孪生素数猜想,被GPT-6破新纪录! 北大数学07级苏炜杰:很震撼

2026年9月3日,OpenAI宣布GPT - 6将孪生素数问题最好上界推进到186,打破陶哲轩保持十二年的纪录。此前Julia Stadlmann推到240,Axiom Math压至212。GPT - 6展现数学直觉,证明经Lean 4验证。

新智元
新闻资讯7

腾讯把WorkBuddy这张王牌,开放给100多家公司|甲子光年

9月2日,腾讯WorkBuddy举办生态发布会,开放平台正式上线,首批引入超百家生态伙伴,开放底层Agent能力。其在AI办公赛道竞争激烈、产品同质化的背景下做出此开放动作,且面临生态繁荣、商业化等问题。

甲子光年
新闻资讯7

向量数据库要被取代?DynamoDB 开始原生支持 AI 搜索

Amazon DynamoDB 推出原生向量搜索,允许开发者将嵌入向量与应用数据存一起,直接在其中运行近似最近邻查询,无需单独向量数据库。介绍了功能特点、成本计费及开发者反馈等。

InfoQ
开源动态8

当 Agent 尝试接管浏览器,连“我是人类”都证明不了?上海交大开源发布交互评测基准 HLL

随着多模态大模型发展,Web Agent 面临验证码挑战。上海交通大学等团队发布 HLL 评测基准,解耦真实度为三维度,对 8 款前沿模型测试,揭示 Agent 在多步交互微操上的短板。

深度学习自然语言处理
产品应用8

实测 Seed 2.1:豆包基模超进化,国产模型能力跨过质变点

作者在做面向 Agent 项目时,因 Claude Code 内存开销大,需更轻方案。火山引擎 Force 大会发布 Seed - 2.1,作者实测其在办公、编程、图像理解等方面表现出色,认为它跨越质变点,将赋能国内 AI 生态圈。

特工宇宙
新闻资讯8

伯克利神作背刺OpenAI:持续学习才是真神!

伯克利等机构发布FST框架,通过快慢分层解决大模型持续学习死局。过去两年头部实验室都在提升模型推理能力,却忽视持续学习。FST让模型像大脑一样快慢分层,提升数据效率、减少遗忘,使持续学习可工程化。

新智元
开源动态8

英伟达MIT出手!华人团队重磅开源,大模型推理内存暴降10倍

英伟达、MIT、浙大华人研究者联合推出TriAttention,核心是在pre - RoPE空间用Q/K三角集中度估计KV token重要性,保留关键部分。它使内存消耗降10倍,吞吐量提2.5倍,还提供vLLM集成和MLX实验性支持。

新智元