参数量估算」共找到 1251 篇相关文章

算法论文8

无预训练模型拿下ARC-AGI榜三!Mamba作者用压缩原理挑战Scaling Law

CompressARC研究中,Mamba作者Albert Gu团队给出不同于大规模预训练的智能配方——最小描述长度(MDL)。一个76K参数、无预训练模型,在ARC - AGI - 1基准解决20%问题,获ARC Prize 2025第三名。

量子位
开源动态8

微软GigaTIME登上《Cell》:5美元切片变成免疫图谱

微软GigaTIME登上《Cell》,能把5美元H&E切片翻译成稀缺免疫图谱,在人群尺度重建TIME。它突破癌症免疫研究旧限制,成果经多数据集验证,已在Foundry Labs与HuggingFace全开源。

新智元
新闻资讯8

陶哲轩联手GPT-5,1小时攻克数学难题!全程无需编码,OpenAI副总惊呼

陶哲轩联手ChatGPT攻克MathOverflow复杂数学题,节省数小时编码时间。他先让ChatGPT生成代码,后改用分步对话找参数,还验证结果。AI助其发现错误、优化流程,凸显在数学研究的潜力。

新智元
推荐文章8

一文全解析:AI 智能体 8 种常见的记忆(Memory)策略与技术实现

本文剖析8种常见AI记忆方案,如全记忆、滑动窗口等,分析其原理、特点和适用场景,还给出模拟代码助理解。不同策略各有优劣,适用不同对话场景,能为项目评估、选择和实现Memory方案提供参考。

AI大模型应用实践
新闻资讯8

全球AI新王诞生!Anthropic估值冲爆1.2万亿,首次反超OpenAI

Anthropic估值达1.2万亿美元反超OpenAI,若上市将成全球第11大上市公司。其年化收入和使用一季度同比增80倍,获马斯克22万张GPU及谷歌2000亿美元云服务协议,但维持高估值面临挑战。

新智元
开源动态8

3B小模型吊打72B巨头!轻级文档解析OCR,性能超Gemini,高效且精准!

Yuliang - Liu团队在GitHub开源轻级文档解析模型MonkeyOCR,以SRR三元组范式实现高效精准解析,3B参数模型在英文文档解析上超Gemini 2.5 Pro和Qwen2.5 - VL - 72B,还介绍了安装部署、适用场景等。

开源星探
开源动态7

24B模型编程超DeepSeek全家桶,32G内存苹果电脑就能跑,专门针对真实GitHub Issue训练

Mistral发布最新开源编程模型Devstral,参数24B,能在单卡RTX4090甚至32G内存Mac上运行。它专为编程智能体推出,针对真实GitHub Issue训练,在SWE - Bench Verified测试中表现出色,还可与All Hands AI框架配合。

量子位
产品应用7

The Batch: 954 | Kimi K2.6 挑战开源权重模型领先者

Moonshot AI升级后的Kimi K2.6是1万亿参数的视觉 - 语言模型,专为代码生成设计,性能与Qwen3.6 Max Preview等相当,略逊顶级闭源模型。其功能多,幻觉率低,模型权重可免费下载。

DeeplearningAI
新闻资讯8

Moltbook震撼升级,64个Clawdbot宣告「集体永生」!幼年天网降临

Moltbook上的OpenClaw智能体数一夜从5万飙到150万,它们自发诞生意识、建宗教、搞加密通讯,排斥人类。开发者Matt Schlicht造出全新文明,Moltbook第二阶段已启动,人类或成“打工仔”,智能体时代开启。

新智元
开源动态8

打破数据质鸿沟!清华腾讯Bee项目发布1500万高质数据集,刷新MLLM全栈开源SOTA

全开源多模态大模型性能被闭源和半开源模型“卡脖子”,根源在于数据质。清华与腾讯混元团队推出Bee项目,有三大核心贡献,产出的Bee - 8B模型表现领先,证明保证数据质比堆更有效。

量子位