「K2 - VL」共找到 2363 篇相关文章
豆包专业版实测:2亿人都可以体验能干活的Agent了!
6月24日,豆包上线专业版,搭载首个Agent驱动的办公任务模式。实测显示其在办公场景交付质量对标Claude Opus 4.6。2亿日活用户可体验,免费用户功能升级,专业版满足复杂任务额度需求。
Google 最新的 Gemini 2.5 Flash-Lite 原型能动态生成软件界面
Google最新的Gemini 2.5 Flash - Lite原型能动态生成软件界面。它打破传统预设框架,通过‘UI宪法’等设计保证风格与适应性,响应速度快,还解决了生成界面可能带来的混乱问题,或重塑人机关系。
港大开源 Paper2Slides,一条命令,把论文变成专业幻灯片!
在AI辅助办公赛道,PPT生成一直是竞争热点,但存在好看不好用、好用不准确的问题。港大开源的Paper2Slides项目,能一条命令把论文转成专业幻灯片,还能做海报,解决了AI幻觉问题。
百度Qianfan-VL,发票/图表/合同等PDF识别94.75%刷新纪录!
当前主流视觉 - 语言模型在企业级应用有难点,百度千帆团队提出Qianfan - VL系列多模态大模型,在通用和企业级任务表现出色,基于自研芯片训练,还提供框架与管线降低成本。
谷歌推出 Jules:一款基于 Gemini 2.5 的异步编程智能体
谷歌将异步智能编程助手 Jules 正式发布,它基于 Gemini 2.5 Pro 模型,可执行多种编程活动。采用异步模式,直接接入代码库。测试阶段开发者反馈多,正式版有三种访问层级,但部分用户对其界面和输出质量不满。
反击AI论文!arXiv每年拒掉2%造假内容,自动化工具加入审核
AI生成论文泛滥,arXiv等预印本平台升级审核机制,用自动化工具检测。Nature发现每年约2%论文因AI使用被拒,如bioRxiv等平台每天拒绝不少AI手稿。平台既要防造假,又要避免误伤合理AI润色。
1分钟跑出数百预测!WeatherNext 2把短时预报带入小时级
谷歌DeepMind发布WeatherNext 2,能1分钟从同一初始场生成上百种未来,分辨率达1小时级,超上一代。它已接入Search等,重写天气预报逻辑,让预测从确定变多可能,还将改变气象体系。
万帧?单卡!智源研究院开源轻量级超长视频理解模型Video-XL-2
长视频理解是多模态大模型关键能力,当前开源模型有短板。智源研究院联合发布 Video-XL-2,多维度优化长视频理解能力,还设计效率优化策略,在主流评测基准表现出色,有广泛应用潜力。
半个月暴涨23k+ Star,一行命令让任意软件 Agent-Native!
介绍开源项目`CLI-Anything`,它用CLI作AI Agent与软件桥梁,有全新思路。半个月Github涨23k+ Star,能一键生成CLI,对接真实后端,但也有依赖代码质量、不适闭源软件等局限。
豆包上可以体验 Seedance 2.0 了,我已经试了一下。
Seedance 2.0是字节自研视频生成模型,已接入豆包App、电脑端和网页版。支持文生视频、图生视频、分身视频等,动作自然、镜头连贯,生成质量高,还解决了创作者出镜难题,操作也简单。