「预发布模型」共找到 9159 篇相关文章
梁文锋首次开口融资,DeepSeek只估值680亿,融资20亿?
据媒体报道,AI初创公司DeepSeek正洽谈以100亿美元估值融资至少3亿美元。该公司此前拒绝融资,此次或因自建数据中心、研发新模型等需大量资金。同时,其两位核心人员跳槽,人才竞争激烈。
FLUX.2开源了,但是我好像也看到了小公司的无力。
AI绘图曾经的王者FLUX.2部分模型开源,包括dev和即将开源的klein。但与Nano Banana Pro对比,其生图、改图及世界知识表现欠佳。这凸显小厂在大厂资源碾压下的无力,但开源仍有价值。
AI引发K型分化:Gemini 3 加剧技术劳动力分化,判断力为王,基础岗位将被AI完全替代,程序员也不例外
2025年11月Google发布Gemini 3,依托多模态MoE架构和“Deep Think”模式,在软件工程等领域实现推理能力质的飞跃。它使前端开发工作重心转移,重构软件工程工作流,赋能白领但带来隐患,还冲击劳动力市场,提升软件掌握门槛。
这次,LLM黑盒被LLM打开了~
随着大语言模型(LLM)能力提升,其内部机制更不透明。概念描述新范式用另一个 LLM 自动生成自然语言解释。介绍了描述对象、生成方法、评估指标,还提及社区关注方向,指出结合多种手段才能把解释变知识。
想知道你的LLM API被过度收费了吗?隐藏的Tokens终于可以被审计了
马里兰大学CASE Lab团队研究商业不透明大模型服务(COLS),定义其风险,提出三层审计蓝图。还推出验证框架CoIn,能高效识别token数量膨胀,有可定制性且审计开销低,为构建信任提供技术支撑。
腾讯混元 TurboS 技术报告首次全公开:560B 参数混合 Mamba 架构,自适应长短链融合
日前腾讯混元 TurboS 技术报告全公开。它是超大型 Hybrid Transformer - Mamba 架构 MoE 模型,有自适应长短思维链机制,总参 560B。在多榜单成绩亮眼,多语种和多任务处理能力强,还介绍了核心创新、训练策略等。
Graph工程的尽头是,Ontology工程
15家机构联合发布图工程系统性综述,指出此前“XX工程”范式多优化单个智能体,而图工程能将智能提升到系统层面。论文还指出图工程语义局限,认为本体工程可作下一代系统智能语义地基。
4.8亿美元砸向端侧算力!Agent芯片新贵冲出重围
成立不到三年的Acrab成亚洲AI芯片新贵,累计融资超4.8亿美元,新资金用于扩产、拓展生态及研发下一代平台。该司押注端侧算力,发布芯片GΞLIX 1和Agent Box,其产品进入量产验证。
再封神!OpenAI掀翻AI图像生成,极度逼真,立刻商用
网传OpenAI的GPT-image-2正在灰度测试,韩国网友测试后称其生成图像可‘立刻商用’。它深度融合GPT大语言模型,生成照片更逼真,强化了提示遵循和场景理解能力,让AI图像生成进入‘实用时代’。
全球第一,13个SOTA!我们找到了龙虾界掌管GUI的神
明略科技推出自研 GUI-VLA 智能体模型 Mano-P 1.0,不依赖 API 对接与浏览器场景,可操作桌面软件与网页界面。它在 13 个多模态基准榜单达 SOTA,支持本地运行,数据零上云,采用分阶段开源策略。