Gemini 3.2 Flash」共找到 3762 篇相关文章

开源动态8

一个LoRA实现GPT-4o级图像编辑!浙大哈佛新模型冲上Hugging Face榜二

随着Gemini、GPT - 4o等把基于文本的图像编辑推向高峰,提高性能常需大量数据和大参数量模型。而浙大哈佛团队提出ICEdit,用少量数据和参数实现高质量图像编辑,媲美甚至超越商业大模型。

新智元
算法论文9

ECCV 2026|不靠「上帝视角」,也不等「完美指令」:REAL 让具身智能体走向开放世界

上海交大与上海AI实验室团队的研究,针对当前具身智能依赖理想化环境与指令假设的痛点,提出REAL框架,统一主动探索、意图消歧与执行为闭环,支持零样本迁移至真机,已开源代码并被ECCV 2026接收。

机器之心
开源动态7

16个月后Meta杀回开源,小扎力挺蒸馏

Meta发布新开放AI模型Muse Glimmer底层参数,未来几周将开放Muse Spark 1.2模型权重。扎克伯格力挺开源,称要为数十亿人提供免费强大AI,还为模型蒸馏辩护。Meta此举有现实压力,也想创造算力需求。

机器之心
开源动态8

图像、视频一模搞定!字节全能原生多模态本地可部署

字节开源原生多模态模型Lance,仅3B激活参数,40G显存就能跑,已登顶huggingface趋势榜。它能进行图像与视频的理解、生成、编辑等操作,在多个基准测试中表现优异,多项性能居首。

AIGC开放社区
新闻资讯7

首个语音智能体端到端测评出炉:Grok登顶,真实场景通过率仅一半

Artificial Analysis推出业内首个语音转语音智能体端到端性能基准τ - Voice,测试真实客服场景能力。结果显示最强S2S模型成功率刚过一半,Grok Voice Think Fast 1.0夺冠,但也面临诸多质疑。

AI工程化
产品应用8

刚刚,Thinking Machines出手!首款交互模型来了,翁荔出镜实测

Thinking Machines Lab推出首个大模型TML - Interaction - Small,打破传统人机交互模式,实现全自然交互。它训练范式独特,采用双模型架构等设计,评测表现超GPT - Realtime 2.0等模型,后续还会推出更大尺寸模型。

机器之心
产品应用7

Codex在推理框架上能蹬出什么优化

作者复盘用Codex在SGLang中的实践,原本需3 - 4个月的工作量现缩短为1个半月。介绍保证代码质量方法,分享印象深刻的debug经历,列举在SGLang用Codex一个月的优化成果,还提及Claude Code使用遇阻。

GiantPandaLLM
产品应用7

我做了个 Skill:让 AI 帮你生成 Logo 和图标

作者因用 Gemini 为 CodePilot 生成 Logo 获关注,开发了 Logo Generator Skill。该 Skill 可三步生成 Logo 与高级展示图,还介绍了不直接用 AI 画 Logo 的原因、使用场景、开源地址与安装方式。

歸藏的AI工具箱
新闻资讯7

大基金投资,安徽又跑出一家芯片IPO

4月10日,全芯智造IPO辅导状态更新为“辅导验收”。这家成立不到七年的制造类EDA企业,创始人是行业“老兵”倪捷,技术覆盖制造关键环节,虽营收破5亿但净亏超3亿,获大基金等投资,有望推动国产替代。

芯师爷
新闻资讯7

关于内存价格转跌,我们和贸易商聊了聊

3月30日,服务器内存贸易商称内存价格从前几天开始跌,30日跌得最凶。国内DDR4价格跌幅超30%,DDR3价格腰斩,DDR5较坚挺。谷歌新算法引发市场震动,从业者认为DDR4暴跌还有其他原因。

芯师爷