上科大」共找到 6422 篇相关文章

推荐文章8

有手就行,教你从0到1快速手搓搭建个GUI Agent

随着通用模型发展,搭建GUI Agent难度降低。文章介绍如何用通用模型API,从0到1搭建PC GUI Agent,包括原理、代码实现等,该Agent能跨应用操作,未来可强化功能。

腾讯技术工程
算法论文8

Evaluation is All You Need:评估设计的微小差异如何扭曲结果

论文以DeepSeek - R1 - Distill系列模型为例,指出模型评估中看似客观的基准测试结果对评估细节极度敏感,细微评估条件变化会致分数波动,削弱模型对比可信度,呼吁建立新评估标准。

深度学习自然语言处理
新闻资讯7

初稿出炉:首部AI数据标注合规标准,欢迎参与起草与研讨

数据标注影响模型性能,国家正推进数据标注产业发展,但行业合规问题突出。智合标准中心启动《面向人工智能的数据标注合规指南》团体标准研制,初稿已出,邀多方参与起草,标准将助AI企业解决合规难题。

AI工程化
新闻资讯8

DeepSeek之后,中国AI「自己出题」杀进Nature通讯!全球仅4家

一家成立不到两年的香港AI公司维纳智能,不堆参数、不依赖人工标注,靠让模型自动生成高精度推理数据登Nature通讯。其技术可解决Agent泛滥的困局,还推出特色产品,业务增长快。

新智元
开源动态7

如何重现 DeepSeek 推理性能突破

DeepSeek-V3 是热门开源模型,采用规模 MoE 架构,优化推理性能是工程难点。阿里团队在 RTP - LLM 完成优化,对齐其推理系统性能,分享关键技术、不足与思考,还提及对 Qwen3 模型的优化策略。

InfoQ
新闻资讯7

256G内存条涨到天价:不是内存条疯了,是算力正在变成新土地

近期,256GB内存条单根突破4万元。这并非普通DDR5,而是服务器专用内存。其价格飙升源于供需错配,模型训练对容量内存需求极端。有人认为是泡沫,也有人觉得是结构性变化。

芯师爷
推荐文章7

我的 2025 总结:当 AI 开始释放创造力,工程师如何重新站位

2025 年 AI 开始释放创造力,重新定义知识工作。作者在编程向创造性工作倾斜,设计适配 AI 的架构、落地 DSL;写作 AI 提升生产力但削弱创作欲。2026 年需探索新竞争力,实现角色转变。

phodal
开源动态8

彻底戳穿AI「失忆症」!超越OpenAI全局记忆,中国队开源LLM记忆操作系统

语言模型有「记忆」缺失问题,国内顶尖团队打造出操作系统级AI记忆框架MemOS并开源且可商用。它将「记忆」升为「一级资源」,用MemCube封装记忆,评测显示性能优于OpenAI全局记忆方案。

新智元
新闻资讯7

微软谷歌正在力招「电工」

巨头围绕AI的人才争夺战扩至能源领域。微软、谷歌等厂纷纷扩招能源专家团队,互挖墙脚。缺电已成AI发展瓶颈,厂也在核电、核聚变项目投资,还可提高数据中心能源效率。

量子位
算法论文8

突破高分辨率图像推理瓶颈,复旦联合南洋理工提出基于视觉Grounding的多轮强化学习框架MGPO

先进多模态模型处理高分辨率图像有瓶颈,复旦和南洋理工研究者提出基于视觉Grounding的多轮强化学习方法MGPO,能让模型精准推理,还可使模型从答案反馈中涌现视觉定位能力,避免依赖昂贵标注。

机器之心