「设计语言」共找到 2302 篇相关文章
「0污染」LLM理解基准来了!20000道题14个学科全覆盖,来自微软
MMLU-CF是微软亚洲研究院推出的无污染多任务语言理解基准测试,含20000道题、覆盖14学科。通过去污染规则和闭源测试集防数据泄露,保证评估结果可靠,已在Huggingface开放。
Qwen3-Embedding 全揭秘:从技术到服务,打造高效AI产品的关键路径
文章全面揭秘 Qwen3-Embedding,介绍其核心原理、优势、应用场景。还给出在 PAI 和百炼平台的使用方法,含部署、推理、微调等。通过对比实验,凸显其低延迟、低成本特点,未来将成语义理解核心设施。
对话 Ruby on Rails 之父:发自内心恨透 Copilot,手凿代码才是程序员的乐趣
传奇程序员 DHH 做客播客,深入探讨世界观。他虽用 AI 学习,但担忧 AI 编程助手致技能退化,‘恨透’它。还谈及编程经历、语言看法、架构偏好、商业哲学等,观点鲜明,引发关注。
MemOS:一种用于 AI 应用的记忆操作系统
大型语言模型缺乏记忆管理系统,限制其发展。MemTensor与高校联合开源MemOS,它将记忆视为可管理资源,有三层架构,系统化三种记忆类型。评估显示其在推理、检索、加速等方面表现优异。
感知错误率降低30.5%:隐式感知损失让模型主动“睁大眼睛” | UIUC&阿里通义
伊利诺伊大学香槟分校与阿里通义实验室推出多模态推理强化学习算法PAPO。它用隐式感知损失设计,解决感知与推理脱节问题,在多基准测试中表现优,但有KL_prcp Hacking现象。
VLA统一架构新突破:自回归世界模型引领具身智能
北京智源研究院联合中科院自动化所提出 UniVLA 全新 VLA 模型架构,基于全离散、自回归机制建模多模态信号,后训练引入世界模型。它刷新多项基准纪录,在真机操控和自动驾驶有潜力,为多模态感知决策融合带来新思路。
推出4个月就狂赚3亿?!百万用户应用CTO弃Copilot转Claude Code:200美元拯救我的137个应用
Anthropic 公司推出的 AI 编码助手 Claude Code 推出 4 个月吸引 11.5 万开发者,单周处理 1.95 亿行代码,年化收入预估达 1.3 亿美元。开发者认为它优势明显,Soham 级别的生产力,还分享使用技巧。
统一架构新思考,北大团队UniWorld-V1统一大模型
北大袁粒课题组提出统一大模型架构UniWorld-V1。通过对GPT - 4o - Image实验,发现其依赖语义编码器提取视觉特征,据此设计架构,在多基准测试表现优异,开源代码等促进研究。
图灵奖得主Bengio再创业:启动资金就筹集了3000万美元
图灵奖得主Yoshua Bengio官宣再创业,成立非营利组织LawZero构建下一代AI系统,不做Agent。已筹3000万美元启动资金,要做“设计即安全”的AI,以监督Agent,将安全性置于商业利益之上。
OpenAI:GPT-5就是All in One,集成各种产品
OpenAI研究副总裁剧透GPT - 5将整合Codex、Operator等产品。团队分享Codex详情与未来计划,回应10大问题,如语言选择、运行方式等,还将推免费API积分,发布了Codex上手指南。