Qwen-VL-30B」共找到 728 篇相关文章

新闻资讯7

开源模型TOP5,被中国厂商包圆了

10月公开数据显示中国开源大模型占据榜单前五,阿里Qwen系列和DeepSeek影响力深远。从LMArena榜单、HuggingFace数据看,国产模型表现佳。还提及Llama 5相关传闻。

量子位
新闻资讯7

OpenAI收购Windsurf失败

Techcrunch消息,谷歌聘请Windsurf的CEO等成员加入DeepMind团队,Windsurf被Cognition收购,OpenAI收购计划失败。Windsurf此前已筹超2亿美元,曾估值12.5亿美元,吸引OpenAI以30亿美元收购。

AIGC开放社区
新闻资讯7

直播预约 | 世界模型,点燃下一个AI爆点(第二期)

本周三‘世界模型’沙龙反响热烈,决定加场。4月23日19:00 - 20:30,机器之心集结4位专家探讨世界模型前沿话题,包括刘子纬、赵行、贾奎、刘桂良,直播在机器之心视频号进行。

机器之心
开源动态8

Hugging Face开源顶级模型:双模式推理+128K上下文,最强3B

今天凌晨,Hugging Face开源顶级小参数模型SmolLM3,参数30亿,性能超同类。它有128k上下文窗口,支持6种语言、双推理模式。架构细节等全开放,联合创始人强烈推荐,称是3B领域SOTA。

AIGC开放社区
开源动态7

这个框架让大模型省下50%内存,合并专家不如直接删掉?

Cerebras Research提出REAP框架,通过专家剪枝和合并技术压缩SMoE模型,能让模型‘瘦身’并保持性能,可省50%内存,但社区测试有不同结果,且存在调度开销等问题。

AI工程化
产品应用8

腾讯云TencentOS智能运维平台TManager正式发布 | Q推荐

为满足企业运维需求,腾讯云推出 TencentOS Server 首款智能运维管理平台 TManager。它有 30 余项功能,能 AI 智能诊断,内部稳定运行多年,覆盖复杂场景,还赢得标杆客户信任,提升运维智能化水平。

InfoQ
算法论文7

Zero-RAG,对冗余知识说“不”

文章指出大语言模型知识冗余,RAG 检索效率低。复旦大学邱锡鹏提出 Zero - RAG,能精准识别并剪除冗余知识,砍 30%语料准确率掉点小,检索延迟降 22%,还介绍了其技术方案。

PaperAgent
新闻资讯7

烧Token成KPI,8.5万Meta员工狂刷60万亿Token,争榜一大哥

硅谷兴起“tokenmaxxing”,将token使用量作为生产力基准和竞争指标。Meta超8.5万员工参与烧token竞赛,30天消耗超60万亿。国内阿里、腾讯也有相关动作,科技大佬推波助澜,Anthropic年化收入破300亿美元。

机器之心
算法论文8

不换模型,效果提升104%!上海AI Lab让Harness也能自进化了

上海人工智能实验室团队提出的Self-Harness引发关注,它针对Agent外层Harness改进。实验显示,在Terminal-Bench-2.0上,不换模型只改Harness,Qwen3.5-35B-A3B等模型效果显著提升。

量子位
新闻资讯7

250 个岗位换两亿“求生”资金?巅峰781 亿市值巨头节流押注 AI,CEO急踩 “创业模式” 刹车

自由职业服务平台 Fiverr 宣布裁员 250 人,约占员工总数 30%,是为转型“AI 优先”企业的重组举措。创始人兼 CEO 称能省两亿,还可提升员工生产力。此前他就预警 AI 会影响工作。

AI前线