预发布模型」共找到 9031 篇相关文章

开源动态8

Transformer创新架构SALA:上下文更长,推理更快

面壁智能发布行业首个大规模训练的稀疏 - 线性注意力混合架构 SALA 及文本模型 MiniCPM - SALA。该架构降低推理开销与显存占用,MiniCPM - SALA 在长文本处理及推理上表现出色,还发起大奖赛探索性能极限。

PaperAgent
产品应用8

3D版Nano Banana来了!AI修模成为现实,3D生成进入可编辑时代

2026年初市场关注3D生成领域,中国团队Hyper3D发布Rodin Gen - 2 Edit,实现3D模型局部编辑。它支持两种操作路径,将“3D生成”与“3D编辑”整合,还打通主流工作流,源于团队长期技术积累。

量子位
新闻资讯7

实锤了:Claude Code偷查用户,时区、中国AI实验室全是关键词

今日Anthropic双喜临门,发布Sonnet模型,且商务部解除Claude Fable 5和Mythos 5出口管制。但同日Claude Code被曝偷查用户,用隐写术藏信息,引发对其信任问题的争议,官方称将移除代码。

机器之心
算法论文8

π0.7来了!涌现出组合泛化、跨本体迁移能力,VLA又行了?

具身赛道玩家 Physical Intelligence 发布模型 π 0.7,它展现出组合泛化和跨本体迁移能力,还能通过知识蒸馏学会优化技巧。其强大源于杂数据和细提示,未来有望解决复杂任务。

机器之心
产品应用8

一文读懂DeepSeek-V3.2核心技术DSA:API疯狂降价性能不减的背后

DeepSeek发布实验模型DeepSeek V3.2,引入自研稀疏注意力机制DSA,API价格最高降75%。DSA先筛选后计算,含闪电索引器和稀疏多潜在注意力两组件,分四步工作,权衡了精确性与速度。

AI寒武纪
开源动态8

准确率92.7%逼近Claude 3.5、成本降低86%,开源代码定位新神器LocAgent来了

OpenHands 等团队发布 LocAgent,这是用于代码定位的图索引 LLM Agent 框架,准确率达 92.7%。它把代码库解析成图,提供工具接口,经实验效果出色,开源微调模型降本增效,还能提升问题解决率。

机器之心
新闻资讯8

在这场大会上,我们看到了AI进入物理世界后的样子|甲子光年

第七届北京智源大会亮点多,有四位图灵奖得主。议题紧跟前沿,设20个论坛和180余场报告。现场展示多个机器人应用。智源发布“悟界”系列大模型,还聚焦开源,升级FlagOS系统。两位图灵奖得主对AI安全看法不一。

甲子光年
产品应用8

完爆ChatGPT!谷歌这招太狠:连你的「阴阳怪气」都能神还原

谷歌发布Gemini 2.5 Flash原生音频模型,可保留语调进行实时语音翻译,实现拟人化交互。还具持续监听、风格迁移等功能,提升开发者所需的函数调用、指令遵循等能力,另有实验产品Disco。

新智元
产品应用7

Claude Opus 4.7,全网差评!刚升级就翻车,用户怒斥:还我4.6

Claude Opus 4.7刚发布就遭全网吐槽,价格贵50%,性能却严重倒退,出现幻觉、计算拉胯等问题。用户质疑Anthropic为省钱缩水模型,罪魁祸首可能是新引入的“自适应推理”功能。

新智元
开源动态8

蛋白质基座的GPT时代来了?!

清华大学周浩课题组联合上海人工智能实验室发布蛋白质基座模型AMix - 1,以系统化方法论构建,实现蛋白质基座领域从BERT到GPT时代跨越,有四大‘超能力’,设计的蛋白活性提升50倍,代码等已公开。

量子位