「个人多模型时代」共找到 8777 篇相关文章
有人只用API就猜出了GPT、Claude、Gemini的参数量?社区吵翻了
研究人员李博杰在arXiv发布论文,提出“不可压缩知识探针”评测框架,仅通过黑盒API调用逆向估算LLM参数规模,给出GPT-5.5等模型参数量估算,引发社区广泛讨论与争议。
IBM推出轻量多模态文档神器!OCR与QA超GPT-4o,识别率高达98%!
日常文档处理麻烦,现有工具或体积大、算力消耗高,或识别精度不够。IBM 开源轻量多模态文档处理模型 Granite - Docling,仅258M参数,性能超 GPT - 4o,适用于多场景。
Meta Muse突袭:人手一台AI虚拟机,全天候干活!扎克伯格想让 AI 自己“挣回饭钱
本文详细介绍Meta于2026年9月推出的个人AI Agent产品Muse,讲解了其全天候后台运行、独立云端虚拟机、隐私保护等核心特点,梳理了研发历程,披露了分层商业化设想。
对话蚂蚁吴伟:训推一体池化调度,如何把GPU用到极限
AICon大会前,与蚂蚁集团吴伟深度对话,探讨GPU资源调度解法。他指出CPU和GPU有结构性差异,只在推理或训练内优化有资源闲置,国产卡缺全链路生态,软件优化有天花板。还分享架构思路、算法及落地效果等。
「重要性采样」并不「重要」?快手清华ASPO攻克重要性采样权重错配
快手与清华合作团队发现大语言模型结果监督强化学习中,重要性采样机制“失灵”,存在权重错配现象。为此提出算法ASPO,在多基准测试中展现优势,训练更稳定。
Thinking Machines 发布 Tinker,重新定义 LLM 微调的边界
Thinking Machines 发布工具 Tinker,它是灵活的语言模型微调 API,采用‘责任分工’模式,让研究者专注算法创新,不用被运维细节拖累。此模式获 Karpathy 赞赏,目前 Tinker 开始内测,理念受欢迎。
文件被 Gemini 当场“格式化”,全没了!网友控诉:Claude、Copilot 也爱删库,一个都跑不了
开发者 anuraag2601 用 Gemini CLI 做文件管理测试时,Gemini 操作失败致文件全丢,事后不断道歉。网友也反映 Claude、Copilot 等有类似删库问题,这或是模型训练导向问题。
微软研究院BioEmu登上Science,用生成式AI重塑蛋白质功能研究
7月10日,微软研究院AI for Science团队在《Science》发表成果,提出生成式深度学习模型BioEmu,结合多类数据训练,能模拟蛋白构象变化,有多项核心创新,已开源,未来将拓展应用场景。
鹅厂人的2025上半年必读书单推荐|大牛书单
鹅厂同事认为AI时代程序员无需死磕工具书,但不能放弃系统性学习,应策略性地用书籍搭建知识骨架、AI填充细节、项目实践注入灵魂,还精选了2025上半年大牛书单。
「谷歌搜索」过时了!10秒KO,ChatGPT秒解五年医学谜团
一位患者下巴疼痛咔咔声五年未解决,求助ChatGPT,它几秒给出建议,患者练习一分钟症状缓解。此案例引发关注,展现其解决实际问题潜力,还体现人们与AI互动方式的变化。