「领域特定语言」共找到 2858 篇相关文章
AI游戏创新大赛线下终极对决!世纪华通发起,ChinaJoy见证最终冠军诞生
7月23日,世纪华通发起的“数龙杯”全球AI游戏及应用创新大赛在上海举办线下路演。20余款AI作品团队展示创新成果,覆盖多领域。评审严格考评,最终结果8月1日在ChinaJoy揭晓。
Distilabel DeepSeek-R1 模型蒸馏教程
文章介绍结合distilabel与QLoRA技术定制专属大模型的路径。先用distilabel框架利用DeepSeek - R1生成医疗指令数据集,再用QLoRA技术微调Qwen3 - 4B模型,还给出实战路线图和代码示例。
「0污染」LLM理解基准来了!20000道题14个学科全覆盖,来自微软
MMLU-CF是微软亚洲研究院推出的无污染多任务语言理解基准测试,含20000道题、覆盖14学科。通过去污染规则和闭源测试集防数据泄露,保证评估结果可靠,已在Huggingface开放。
Qwen3-Embedding 全揭秘:从技术到服务,打造高效AI产品的关键路径
文章全面揭秘 Qwen3-Embedding,介绍其核心原理、优势、应用场景。还给出在 PAI 和百炼平台的使用方法,含部署、推理、微调等。通过对比实验,凸显其低延迟、低成本特点,未来将成语义理解核心设施。
小扎开建「人类第一算力帝国」!26年榨干当地水电,27年超越星际之门
Meta进军AI超算领域,扎克伯格宣布2026年启用1GW「Prometheus」集群,2027年建成占地如曼哈顿的「Hyperion」计划部署超5GW级算力,Meta还将自建天然气电厂,力抗OpenAI与马斯克。
只因一个“:”,大模型全军覆没
一篇论文发现冒号等符号、“Thought process:”等语句能欺骗LLM,让虚假回答通过。实验表明所有测试模型都会触发假阳性响应。研究人员构建新“评委”模型Master - RM,可让假阳性率接近0%。
对话 Ruby on Rails 之父:发自内心恨透 Copilot,手凿代码才是程序员的乐趣
传奇程序员 DHH 做客播客,深入探讨世界观。他虽用 AI 学习,但担忧 AI 编程助手致技能退化,‘恨透’它。还谈及编程经历、语言看法、架构偏好、商业哲学等,观点鲜明,引发关注。
中国中文信息学会大模型与生成专委会2025大模型战略研讨会成功举办
2025年6月27日,中国中文信息学会大模型与生成专委会2025大模型战略研讨会在哈尔滨举办。会议探讨技术革命、交流成果、发布基金,多位专家作报告、参与思辨讨论,聚焦大模型多方面话题。
新紫光集团三周年:智变跃升,交出硬核答卷
2025年7月11日新紫光集团完成战略重整三周年,交出硬核答卷,连续三年营收超千亿,专利增加。其聚焦智能科技主业,通过战略布局、技术攻坚、生态协同实现发展,未来将持续求新求变,深化合作。
MemOS:一种用于 AI 应用的记忆操作系统
大型语言模型缺乏记忆管理系统,限制其发展。MemTensor与高校联合开源MemOS,它将记忆视为可管理资源,有三层架构,系统化三种记忆类型。评估显示其在推理、检索、加速等方面表现优异。