「代码向量模型」共找到 8835 篇相关文章

开源动态8

IBM推出轻量多模态文档神器!OCR与QA超GPT-4o,识别率高达98%!

日常文档处理麻烦,现有工具或体积大、算力消耗高,或识别精度不够。IBM 开源轻量多模态文档处理模型 Granite - Docling,仅258M参数,性能超 GPT - 4o,适用于多场景。

开源星探
算法论文8

「重要性采样」并不「重要」?快手清华ASPO攻克重要性采样权重错配

快手与清华合作团队发现大语言模型结果监督强化学习中,重要性采样机制“失灵”,存在权重错配现象。为此提出算法ASPO,在多基准测试中展现优势,训练更稳定。

量子位
产品应用7

Thinking Machines 发布 Tinker,重新定义 LLM 微调的边界

Thinking Machines 发布工具 Tinker,它是灵活的语言模型微调 API,采用‘责任分工’模式,让研究者专注算法创新,不用被运维细节拖累。此模式获 Karpathy 赞赏,目前 Tinker 开始内测,理念受欢迎。

AI工程化
新闻资讯7

文件被 Gemini 当场“格式化”,全没了!网友控诉:Claude、Copilot 也爱删库,一个都跑不了

开发者 anuraag2601 用 Gemini CLI 做文件管理测试时,Gemini 操作失败致文件全丢,事后不断道歉。网友也反映 Claude、Copilot 等有类似删库问题,这或是模型训练导向问题。

InfoQ
算法论文8

微软研究院BioEmu登上Science,用生成式AI重塑蛋白质功能研究

7月10日,微软研究院AI for Science团队在《Science》发表成果,提出生成式深度学习模型BioEmu,结合多类数据训练,能模拟蛋白构象变化,有多项核心创新,已开源,未来将拓展应用场景。

机器之心
产品应用8

深夜突袭!谷歌Gemini 2.5 Pro更新蝉联榜一:推理超越o3,编程超越opus4

深夜谷歌对Gemini 2.5 Pro模型重大更新,在编码、推理等测试中超越o3,几周内成稳定版。其价格优势大,还增加思考预算,输出风格和结构改进,用户实测反馈佳,但发布不久被越狱攻击。

机器之心
开源动态8

让AI自己“炼数据”!DataChef开源:用强化学习自动生成LLM数据配方

上海人工智能实验室联合复旦大学开源DataChef,它能通过在线强化学习自动生成LLM数据配方。实验显示其能力逼近Gemini - 3 - Pro,超越人类专家设计算法,解决传统数据工程难题,推动大模型数据工程迈向新范式。

OpenMMLab
产品应用7

阿里QwenLong-32B:1W+超长Token推理,知识密集型复杂文档高效推理

文章介绍阿里QwenLong - 32B在长文本推理的能力。长文本推理有训练效率低和优化不稳定问题,QWENLONG - L1通过强化学习等解决,还阐述其组件、训练步骤,并给出实战代码及相关链接。

CourseAI
新闻资讯8

王阳明心学,被Anthropic用来教Claude做人了

UT Austin哲学教授Harvey Lederman研究王阳明心学十年,现加入Anthropic做Claude对齐训练。他用分析哲学拆解“知行合一”,发现AI模型存在“信念冲突”,Anthropic用类似阳明心学方法解决问题。如今硅谷AI公司争抢哲学家。

量子位
新闻资讯7

OpenClaw危了?Claude Code迎来最激进升级:AI 开始直接操控电脑,正面挑战 OpenAI

北京时间昨日夜里,Anthropic 宣布对旗下 Claude Code 与 Claude Cowork 进行关键更新,AI 可直接操控电脑。同日 OpenClaw 也迎来重大更新,重构插件系统、升级模型等。二者更新引发关注,各有优劣。

InfoQ