Qwen-0.6B」共找到 1847 篇相关文章

新闻资讯8

GPT-5.2 上线!全面超越 Claude Opus4.5 及 Gemimi 3.0 Pro

OpenAI 正式宣布 GPT-5.2 全面上线,一口气推出三个版本。GPT-5.2 Thinking 在推理能力上拉开代差,是 OpenAI 首个达人类专家水平的模型。各版本定位清晰,不同用户使用时间有别。

AGI Hunt
推荐文章7

Claude Skills 写作指南:从0到1看完就会,不会来找我

本文介绍Claude Skills写作指南,指出传统提示词使用麻烦,而Skills能解决问题。阐述其适用场景、定义、原理,还讲了创建方法、作者实践及完整写作工作流,可按需管理提示词。

AI产品自由
算法论文8

NeurIPS Spotlight|运动遮挡都不怕,0先验、一段视频精准预测相机参数

论文一作李放等为解决传统方法在动态场景预测相机参数的难题,提出 ROS - Cam 方法,涵盖补丁式跟踪滤波器、异常值感知联合优化、双阶段训练策略,代码即将开源。

机器之心
算法论文7

从BERT到T5再到Qwen3:关于Embedding的八点总结

哈工大30+页综述聚焦通用文本嵌入(GPTE),系统介绍其架构、数据、模型,探讨预训练语言模型(PLM)给GPTE带来的基础能力与高级扩展,还涉及多模态、多语言、代码嵌入等应用。

PaperAgent
开源动态8

「0污染」LLM理解基准来了!20000道题14个学科全覆盖,来自微软

MMLU-CF是微软亚洲研究院推出的无污染多任务语言理解基准测试,含20000道题、覆盖14学科。通过去污染规则和闭源测试集防数据泄露,保证评估结果可靠,已在Huggingface开放。

新智元
开源动态7

vLLM Ascend超越MindIE? 昇腾推理Qwen3与DeepSeek R1 Distill性能实测

国内开发者在昇腾NPU上进行大模型推理面临挑战,华为MindIE推理引擎使用门槛高。昇腾联合vLLM社区推出vLLM Ascend插件。本文用GPUStack平台实测其与MindIE性能差异,得出两者在不同场景各有优势的结论。

AI工程化
新闻资讯7

谷歌流量急坠归0?核心员工被「自愿离职」,30年搜索帝国崩塌

谷歌搜索迎转折点,为支持AI投入向多部门员工提「自愿离职」方案。在线新闻媒体流量受重创,聊天机器人取代谷歌搜索,新闻网站推荐流量暴跌,谷歌称仍致力于为网络带来流量。

新智元
产品应用8

告别卡脖子,华为黑科技破局!昇腾推理加速1.6倍打破LLM降智魔咒

大模型参数规模大,推理部署难。华为诺亚提出Pangu Light框架,结合算法创新与国产昇腾平台,通过跨层注意力剪枝等技术,解决剪枝后模型失稳问题,实现高压缩率、推理加速与高精度。

新智元
开源动态8

斩获6.1 star,再见Crontab!这款开源定时任务管理系统让运维更高效

Gocron是基于Go语言的轻量级定时任务管理系统,可替代Linux Crontab。它有可视化界面、秒级调度等功能,适用于自动化运维等场景,通过Docker一键部署,比同类项目更具优势。

小华同学ai
开源动态8

1.6K Star!阿里开源 zg:一条命令解决 Agent 时代的本地检索难题。

AI Agent 用 ripgrep 检索常遇难题,因代码命名和自然语言有‘词汇鸿沟’。阿里开源的 zg,将三种搜索能力整合进 CLI 工具,可用于终端与人机交互,还介绍了其安装、建索引及搜索的方法。

开源星探