Gemini 3.2 Flash」共找到 3703 篇相关文章

算法论文8

大模型也需要自我反思,上海AI Lab合成“错题本”让大模型数学成绩提升13.3%

上海AI Lab提出LEMMA方法,构建“错误 - 反思 - 修正”数据,让大模型从错误中学习。通过教师模型定向制造“学生会犯的错”构造数据,实验显示在Llama3 - 8B上数学解题准确率提升13.3%。

量子位
产品应用8

Wan2.5+Midjourney V7,阿里夸克这个新AI鲨疯了!价格还砍一大刀

夸克“造点”AI发布,采用Wan2.5+Midjourney V7双强模型联合。它不仅接入Midjourney V7,还率先接入通义万相Wan2.5,开放7天免费体验,且会员价格减半。功能强大,生图、生视频等操作丝滑,移动端还能一句话任意P图。

量子位
算法论文7

超越Claude 3.5和o1!8B模型靠「分层投票+测试时训练」逆袭

近日MIT研究者发现测试时训练在大模型应对复杂推理问题时,能分解任务提升回答准确率。8B的lemma3模型经此方法,在ARC和BBH数据集上性能显著提升,超Claude 3.5等。但该策略部署效率低。

新智元
产品应用7

The Batch: 954 | Kimi K2.6 挑战开源权重模型领先者

Moonshot AI升级后的Kimi K2.6是1万亿参数的视觉 - 语言模型,专为代码生成设计,性能与Qwen3.6 Max Preview等相当,略逊顶级闭源模型。其功能多,幻觉率低,模型权重可免费下载。

DeeplearningAI
推荐文章7

a16z:AI 产品初期用户流失高很正常,M3 留存才是评估 PMF 的关键

a16z研究团队分析数百家AI企业后发现,将衡量用户留存率基准点从M0后移至M3,能更清晰评估PMF和GTM策略。AI产品留存曲线分获客、留存、扩张三阶段,M12/M3比率是预测长期留存关键指标。

Founder Park
开源动态7

谷歌放大招了,开源命令行AI编程Agent,每天1000次免费调用,编程只是基础功能。

Google推出开源命令行AI编程Agent——Gemini CLI,基于Gemini 2.5 Pro模型,免费提供每日1000次调用额度。它不仅能编程,还具备多模态能力、实时信息整合等功能,支持定制与自动化。

开源AI项目落地
开源动态7

突发!Qwen更新模型,全面超越kimi k2,强的离谱,主打Agent

Qwen小更新非推理模型性能强劲,各项指标超kimi k2,与Claude opus 4持平,Agent能力亮眼。Qwen团队告别混合思维模式,新模型上线,独立训练两模型,新版本多方面提升,团队称还有大招。

AI寒武纪
产品应用7

Cursor重大升级!发布2.0版本和首个自研AI编程模型,4倍速AI编程时代来了!

Cursor发布2.0版本和自研AI编程模型Composer。Composer是混合专家模型,速度比同等水平模型快4倍,多数任务30秒可完成。2.0版本新增多代理界面、内置浏览器等功能,降低使用门槛。

开源AI项目落地
新闻资讯7

1.3亿美元!LiblibAI拿下国内AI应用赛道年度最大融资

2025年,AI应用公司LiblibAI完成1.3亿美元B轮融资,由红杉中国等联合领投,老股东超额增持。这是今年国内AI应用赛道最大融资,标志投资热点转向应用层。该平台有独特生态,还将加速全球化布局。

量子位
开源动态8

腾讯发布混元3D世界模型1.0:首个支持物理仿真的开源世界生成系统

在2025年世界人工智能大会上,腾讯发布混元3D世界模型1.0,它是首个开源且兼容传统CG管线的可漫游世界生成模型。可通过文图生成3D世界,支持编辑、仿真,有360°沉浸、工业兼容、原子级交互优势。

量子位