小厂」共找到 1206 篇相关文章

推荐文章7

从大设计师到超级一人公司:6000字回顾我和AI的2025

作者回顾2025年,身份从大设计师变为自由职业者,用AI加持做超级一人公司。自媒体上各平台粉丝量增长,开始做视频;社群活动帮创业者和会员;创作涵盖Vibe Coding、Agent、图像视频等;还介绍合作产品,展望2026年AI趋势。

歸藏的AI工具箱
开源动态8

红书提出DeepEyesV2,从“看图思考”到“工具协同”,探索多模态智能新维度

红书推出多模态模型DeepEyesV2,它延续视觉推理优势,实现代码执行、网页搜索和图像操作的全工具协同。通过多工具协同推理解决复杂问题,采用两阶段训练策略,准确率远超开源模型。

量子位
新闻资讯7

劝人退学、庆幸没读博浪费5年,26岁DeepMind“传奇人物”:大内部分散,AI研究很低效

26岁的Neel Nanda是DeepMind“传奇人物”,他涉足机械可解释性研究四年成果丰硕。在与主持人对话中,他分享经验,认为大内部分散、AI研究低效,还谈及读博、AI安全研究、公司决策等看法。

AI前线
开源动态8

OpenAI未公开的o3「用图思考」技术,被红书、西安交大尝试实现了

OpenAI推出的o3推理模型打破传统文字思维链边界,实现图像融入推理过程。红书与西安交大联合构建多模态深度思考模型DeepEyes,尝试实现类似能力,还开源技术细节,在多任务中表现出色。

机器之心
开源动态8

扎万字檄文炮轰硅谷,Meta重磅开源30B钢炮!一台MacBook就能跑

Meta发布全新30B大模型Muse Glimmer并开源,用4-bit量化等技术让其能在本地设备运行,有五大核心超能力且采用Apache 2.0协议。同时,Meta CEO扎发表万字檄文暗讽OpenAI等,抨击AI末日论等观点。

新智元
开源动态8

Qwen3家族训练秘籍公开:思考/非思考融进一个模型,大模型蒸馏带动模型

Qwen3技术报告揭晓8款模型关键技术,采用双模式架构,训练和微调分段进行,还“大带”蒸馏数据。其融合思考与非思考模式,训练分多阶段,Qwen Chat还全量上线深度研究功能。

量子位
算法论文8

大模型能力,模型成本!Google等 | 提出递归混合框架:MoR, 大幅提升LLM计算效率

Google提出递归混合框架(MoR),融合参数共享与自适应计算。它有轻量级路由和KV缓存策略,在不同路由机制各有优劣。实验显示,MoR在性能、计算和内存效率上表现出色,有望实现“大模型能力,模型成本”。

AINLPer
开源动态8

红书发布FireRedChat:首个可私有化部署的全双工大模型语音交互系统

红书智创音频团队推出业内首个支持私有化部署的全双工大模型语音交互系统FireRedChat,可将半双工链路升级为全双工,提供级联与半级联服务,在多指标领先,让AI有“人感”。

机器之心
开源动态8

抖音&LV-NUS开源多模态新模,以博大刷新SOTA,8B推理比肩GPT-4o

抖音SAIL团队与LV - NUS Lab联合推出多模态大模型SAIL - VL2,以中参数规模在106个数据集实现性能突破。该模型从架构、数据、训练三方面创新,后经全链路优化,在多数据集验证中表现卓越。

量子位
算法论文8

NeurIPS 2025 | 北大联合红书提出Uni-Instruct:ImageNet单步生图FID进入1.0时代!

北大联合红书提出的 Uni - Instruct 框架被 NeurIPS 2025 接收,它统一超 10 种单步扩散模型蒸馏方法,在多项任务达最佳性能,还能用于文本到 3D 生成。

机器之心