Gemini 3.5 Pro」共找到 3808 篇相关文章

算法论文8

大模型也需要自我反思,上海AI Lab合成“错题本”让大模型数学成绩提升13.3%

上海AI Lab提出LEMMA方法,构建“错误 - 反思 - 修正”数据,让大模型从错误中学习。通过教师模型定向制造“学生会犯的错”构造数据,实验显示在Llama3 - 8B上数学解题准确率提升13.3%。

量子位
新闻资讯8

一个大脑搞定所有模态,百度ERNIE 5.0技术报告公布

模型发布近3个月后,百度ERNIE 5.0技术报告公布。其底座用超级稀疏架构,参数量万亿但推理激活参数不到3%,实现四种模态原生自回归统一,还在路由调度、训练范式等多方面有创新。

量子位
产品应用8

Wan2.5+Midjourney V7,阿里夸克这个新AI鲨疯了!价格还砍一大刀

夸克“造点”AI发布,采用Wan2.5+Midjourney V7双强模型联合。它不仅接入Midjourney V7,还率先接入通义万相Wan2.5,开放7天免费体验,且会员价格减半。功能强大,生图、生视频等操作丝滑,移动端还能一句话任意P图。

量子位
开源动态8

音频全能王炸!小米MiMo-Audio开源,力压Gemini/GPT-4o!

小米团队开源通用音频大模型MiMo-Audio,集多种功能于一身,支持7国语言零样本克隆和中英混合合成。首包延迟低,效果自然稳定。在多个基准测试中表现优于Gemini-2.5-Flash和GPT-4o-Audio。

开源星探
推荐文章7

a16z:AI 产品初期用户流失高很正常,M3 留存才是评估 PMF 的关键

a16z研究团队分析数百家AI企业后发现,将衡量用户留存率基准点从M0后移至M3,能更清晰评估PMF和GTM策略。AI产品留存曲线分获客、留存、扩张三阶段,M12/M3比率是预测长期留存关键指标。

Founder Park
新闻资讯8

180 天狠赚 5.7 亿,8 人团队全员财富自由,最大功臣是 Claude 和 Gemini

海外巨头 Wix 斥 8000 万美元收购成立仅 6 个月的 AI 公司 Base44。其创始人 Shlomo 用 AI 打造“开箱即用”开发平台,采用“全栈原生”理念突围。Shlomo 分享创业经历、工具使用及增长策略等。

InfoQ
算法论文8

5秒完成3D场景编辑,北大&港中文&上海AI Lab搞出VGGT-Edit,120倍加速太炸了

北大、港中文等团队提出原生3D编辑框架VGGT-Edit,不再绕回2D,直接在3D空间编辑。它采用残差场预测等机制,在DeltaScene测试集表现出色,单次编辑约5秒,最高120倍加速。

量子位
7

又一个Genie 3来了!刚上线挤爆服务器,Mirage 2把世界模型玩成在线游戏

全球首款AI原生UGC游戏引擎Mirage迎来2.0版本。它能将图像转为可互动3D世界,还能用文本重塑。和Genie 3相比控制类别更丰富,虽有进展但仍有动作控制、视觉稳定等问题待解决。

新智元
算法论文8

小模型大作为!微博的VibeThinker-1.5B超越DeepSeek R1等头部大模型

近年来,“参数越大,能力越强”成行业共识,但带来成本高和资源集中问题。微博AI团队开发的VibeThinker - 1.5B用1.5亿参数和低训练成本,在多项测试中超越头部大模型,还提出SSP框架和MGPO算法。

深度学习自然语言处理
开源动态8

腾讯发布混元3D世界模型1.0:首个支持物理仿真的开源世界生成系统

在2025年世界人工智能大会上,腾讯发布混元3D世界模型1.0,它是首个开源且兼容传统CG管线的可漫游世界生成模型。可通过文图生成3D世界,支持编辑、仿真,有360°沉浸、工业兼容、原子级交互优势。

量子位