Gemini 3.1 Flash-Lite」共找到 3766 篇相关文章

开源动态8

开源Agent模型榜第一名,现在是阿里通义DeepResearch

阿里开源首个深度研究Agent模型通义DeepResearch,在多权威评测集上超越多个Agent模型。它采用多阶段数据策略,有两种推理模式,革新训练流程,已赋能高德出行Agent和通义法睿等应用,且模型等均已开源。

量子位
新闻资讯8

刚刚,OpenAI发布白皮书:如何在AI时代保持领先

AI发展超多数企业适应能力,早期采用者收入增长更快。9月3日OpenAI发布白皮书,总结与大企业合作经验,给出从战略到治理的五大核心原则及多方面重点建议,助企业在AI时代保持领先。

机器之心
算法论文8

ICCV 2025 | 打造通用工具智能体的基石:北大提出ToolVQA数据集,引领多模态多步推理VQA新范式

北大团队提出ToolVQA数据集,用于提升基础模型工具使用能力。它含2.3万条样本,贴近真实需求。通过ToolEngine构建,涵盖多工具与任务领域。微调后模型表现佳,代码与模型已开源。

机器之心
产品应用8

刚刚,智谱推出全球首个手机通用Agent,人人可用

智谱发布新版AutoGLM,是全球首个手机通用Agent。它为用户配备云端手机,能在不影响用户操作的前提下完成各类任务,还在技术上有重大突破,成本更低,代表全新互联网流量。

AGI Hunt
8

两年半后,我不再“写”代码,而是“指挥”一个AI团队

腾讯程序员分享两年半使用AI的经验,涵盖工作与生活。工作中,介绍信息处理、规划、执行、复盘等流程的AI工具及用法;生活里,提及AI在育儿、娱乐等场景的应用,鼓励开放心态尝试。

腾讯技术工程
算法论文8

抛弃预定义Tool,首次提出通过动态工具生成的Agentic多模态Reasoning,破31%涨幅

视觉推理任务中,传统多模态大模型依赖预定义工具,灵活性与领域适应性差。PyVision 框架首次让 MLLM 在推理中实时生成、执行并迭代 Python 工具,在多类任务中显著提升性能,实现范式跃迁。

深度学习自然语言处理
新闻资讯8

微信技术架构部斩获CVPR 2025大赛冠军,攻克AI图文匹配评估难题

微信WXG技术架构部IH-VQA团队在CVPR2025大赛夺冠,首创iMatch图文匹配质量评估方案。文中介绍赛事背景、规则,团队通过双模型驱动等策略获胜,还构建iMatch-Benchmark评估主流T2I模型。

腾讯技术工程
开源动态8

Kimi新模型拿下代码开源SOTA,仅仅72B,发布即开源

深夜,Kimi发布新开源代码模型Kimi - Dev,在SWE - bench Verified上以60.4%成绩获开源SOTA。参数量72B,编程水平强。采用MIT协议,权重和代码已发布。官方透露了部分关键技术,更多细节待后续报告。

量子位
产品应用7

时隔一年,再次使用7个国产AI大模型写高考作文,国产模型的进步也太大了!有彩蛋。

去年评测国产模型写高考作文能力时,各模型问题不少,如用词重复、字数不足。今年再次测试7个国产模型,能力有指数级提升,文采惊人,扣题方面通义千问和文心一言表现出色。文末还有海外模型“翻车”彩蛋。

开源AI项目落地
新闻资讯7

谷歌偷偷上线免费Cursor,程序员饭碗又摔碎了!

Google AI Studio增加build按钮,相当于免费的cursor。能用一句话、图或文件生成完整AI应用并一键部署。可通过对话修改应用,分享应用消耗他人免费配额,利于推广Gemini生态。

探索AGI