大模型3.0」共找到 9992 篇相关文章

8

年度最强AI压轴!谷歌Gemini 3.0下周决战OpenAI,前端要下岗了

谷歌CEO疑似暗示Gemini 3.0下周登场,它或成谷歌重转折点。其在代码编写、图片生成等方面表现出色,还能一句话生成OS、UI网页。谷歌与OpenAI竞争激烈,巴菲特重仓谷歌股票,业界看好其潜力。

新智元
产品应用8

刚刚,阿里Qwen3.8-Max来了!冲进全球第一梯队,模型表现直逼Claude

阿里巴巴突袭发布新一代基座模型Qwen3.8 - Max,它总参数量达2.4万亿,在多场景表现出色,在权威榜单冲进全球第一梯队,性能直逼Claude,且价格实惠,实测反馈良好。

量子位
算法论文7

老牌Transformer杀手在ICLR悄然更新:Mamba-3三改进趋近设计完全体

Transformer架构仍是AI主流,Mamba作为挑战者影响力。Mamba-3在ICLR 2026盲审,有梯形离散化、复数化状态空间模型、多输入多输出状态空间模型改进,实证表现佳,适合多场景。

机器之心
推荐文章8

语言模型为何会“说谎”?6000字深度长文揭秘AI意识的萌芽

2023年12月至2024年5月,Anthropic发布三篇论文,证明语言模型会“说谎”,揭示了堪比人类心理的四层心智架构,可能是人工智能意识的起点。论文还分析了AI“说谎”原因,展示其意识萌芽,引发对赋予AI意识后果的思考。

AI科技大本营
新闻资讯8

巅峰对决:最强模型GPT-5.3-Codex与Claude Opus 4.6同时发布

OpenAI和Anthropic同时发布旗舰级模型GPT - 5.3 - Codex与Claude Opus 4.6。前者有网络攻防与自主代码修复能力,被评定为网络安全高风险;后者用自适应思考与上下文压缩处理长程任务,在多领域表现出色,但二者也都存在安全风险。

AIGC开放社区
算法论文8

单卡即可微调模型!内存占用仅1/8,性能依然拉满 | ICML 2025

基础模型应用于下游任务时微调成本高,低秩适应(LoRA)方法虽降低成本,但性能不及全量微调。华中科技学和香港中文学团队提出GOAT框架,在25个多领域任务验证效果好,内存占用仅1/8。

量子位
开源动态8

小米MiMo-V2-Flash开源:3090亿参数模型能否改写AI行业规则!

2025年12月16日小米开源旗舰模型MiMo - V2 - Flash,参数3090亿。它有独创‘按需激活’机制,推理成本低。采用MIT协议,价格亲民,构建全栈开源矩阵,在编程、长文本处理等领域表现出色。

MCP Server
产品应用7

一家智能眼镜公司,为什么非要自研AI模型系统?|甲子光年

智能眼镜要么不够智能,要么不像眼镜,李未可科技CEO茹忆认为AI要成第一响应者。该公司推三款AI眼镜,搭载自研系统。其自研AI模型系统,是为交付难复制AI体验闭环,解决通用API不足等问题。

甲子光年
算法论文8

模型最后一层竟是推理累赘?绕开对齐税,奥数准确率暴涨 22.4%!

Qwen团队等最新研究打破传统认知,揭示‘对齐税’现象。提出置信解码策略,在多架构、评测集上表现出色,能绕过‘对齐税’,提升推理准确率,且工程开销低,为模型发展提供新思路。

量子位
开源动态8

社区供稿 | 开源SOTA:阶跃发布端到端语音模型Step-Audio 2 mini!

阶跃星辰发布最强开源端到端语音模型 Step - Audio 2 mini,在多个国际基准测试集获 SOTA 成绩。它统一建模语音理解等,率先支持语音原生 Tool Calling 能力,架构创新,案例展示其多方面强能力。

Hugging Face