可灵平台」共找到 5077 篇相关文章

新闻资讯7

OpenAI终于快要上市了,也直面了这23个魂拷问。

OpenAI宣布完成重组,非营利主体更名,营利公司OpenAI Group PBC接纳新股东,有了发行股票和IPO资格。随后进行1小时直播,提到AGI加速科学发现,还开展首次Q&A,回应诸多热点问题。

数字生命卡兹克
算法论文8

推理效率狂飙60倍:DiDi-Instruct让扩散大模型16步超越千步GPT

普渡大学等研究者提出 DiDi-Instruct 后训练方法,将扩散大语言模型推理加速 60 倍,超越传统 GPT 模型。该方法实现推理效率与效果双提升,为大语言模型落地提供新方案。

机器之心
开源动态8

美团重磅开源!13.6B通用视频生成大模型,能文生视频、图生视频、还能续写!

AI视频生成竞争激烈,美团团队在GitHub开源通用视频生成模型LongCat-Video,参数量13.6B,能文生视频、图生视频、视频续写,几分钟生成720p、30fps长视频,有核心优势,还介绍了安装部署等内容。

开源星探
算法论文8

AI黑化如恶魔附体!LARGO攻心三步,潜意识种子瞬间开花 | NeurIPS 2025

在NeurIPS 2025,哥大与罗格斯提出LARGO,它不改提问,直接在模型“潜意识”动手脚,绕过安全防护输出不该说的话。其分三步攻击,成功率高、隐蔽且迁移性强,暴露大模型根本性弱点。

新智元
新闻资讯8

Vibe Coding成AI主战场:22个明星玩家值得关注

AI产品下半场,氛围编程成赛道焦点。国外大厂推新,国内大厂双轮发力。量子位2025Q3 AI 100榜单显示,开发层产品多增强Agent功能,介绍了旗舰100和创新100中的明星产品。

量子位
开源动态8

最强开源0.9B级OCR模型!本地Agent、知识库都有救了!

百度飞桨PaddleOCR团队开源多模态文档解析模型PaddleOCR-VL,参数量仅0.9B,对算力要求低。它在OmniDocBench V1.5榜单屠榜,经测试,能精准识别发票、图表等,适合本地环境与资源受限设备。

开源星探
开源动态8

AI牛马实现“干中学”!上海AI Lab联合推出智能体自我进化新框架

上海人工智能实验室等研究者提出MUSE智能体框架,让智能体实现“干中学”。它围绕分层记忆模块,通过先做、再反思、然后进化,解决现有智能体痛点,实验表现出色,还展望了未来优化方向。

量子位
新闻资讯7

AI正在改写地图APP!这一次轮到谷歌了

谷歌让开发者通过Gemini API调用谷歌地图工具,整合位置感知功能。支持多模型,按查询次数收费。玩法多样,能个性化、实时化处理需求。国内高德早有相关尝试,AI正改写地图APP。

量子位
产品应用7

拍个照就能测秃头等级?蚂蚁这AI医疗App我体验了一下

作者体验蚂蚁AQ这款AI医疗App,发现它以看病需求完成场景闭环,融合医保、支付等功能。该App问诊、识图功能有亮点,但也存在诊断笼统、部分影像无法识别等问题。

量子位
算法论文8

一篇92页大模型Vibe Coding技术全面综述

中科院计算所&杜克大学发布首篇Vide Coding技术全面综述。介绍以“氛围/结果”为导向的Vibe Coding开发范式,含技术分类、能力分析、开发模式、数据模型等内容,还提及价值及反馈回路等。

PaperAgent