「Qwen-VL-30B」共找到 728 篇相关文章
11Labs 增长负责人:搞营销要学着做视频,但创始人出镜会有点自恋
AI语音独角兽ElevenLabs增长迅猛,估值超30亿美元。其增长负责人Luke Harries分享独特策略,如分业务单元管理、重视视频营销、多渠道推广等,还给出团队搭建、产品发布等实用建议。
吉卜力风「手游」爆火,可灵+Midjourney生成的!教程已出,支持复刻
吉卜力风格“手游”在Reddit和推特爆火,它由AI制作,创作者用可灵AI、Midjourney结合文字提示实现效果,公开教程支持复刻。还介绍了制作方法及提示词示例,可灵AI发展势头也很猛。
AI遭遇灵魂拷问!这道题所有模型集体翻车,网友:我也不会啊
图像推理现新难题,在Reddit引发热议,目前无AI能真正解决。国内外支持图像输入的大模型答案不同,原因是对大立方体规格理解不同。结合提示多次尝试,部分大模型能找准方向,人类面对该问题也会困惑。
近期,不错的LLM Agent统一记忆框架综述~
随着GPT、Qwen、Claude等大模型能力提升,LLM-based Agent走向长期任务。论文提出统一框架拆解Agent Memory为四组件,围绕两个数据集复现比较10个方法,还设计出新的低token开销框架。
林俊旸离职后首度发声:万字复盘,大模型下一站「智能体式思考」
前阿里千问负责人林俊旸离职后发文,复盘大模型行业演进,指出 AI 大模型未来主线是智能体式思考。文中分析推理模型崛起的启示,探讨思考与指令融合难题,还阐述智能体式思维含义、强化学习基础设施挑战等。
The Batch: 907 | 小而高效模型的“制作”方法
Mistral AI发布Ministral 3系列模型权重,结合剪枝与蒸馏技术,用级联蒸馏法构建。该系列参数规模有140亿、80亿和30亿,在部分测试中表现佳,训练成本低于传统方式。
逆天!Mata用13个参数26字节让模型正确率从76%飙升至91%
Meta等机构研究人员发布TinyLoRA极致微调技术,配合强化学习,能在几乎不改变大模型原有结构下,用极少数参数激发其推理能力。该技术在数学推理上表现出色,还探索了参数共享策略和存储精度问题。
千问APP悄悄上线,阿里的AI超级入口也终于来了。
阿里千问APP悄悄上线,界面简约,功能增加,支持Qwen全系列最新模型。它将阿里系分散的AI触点收束到“千问”品牌,还默认开启搜索,整合多种功能,让普通用户使用体验更友好。
DeepSeek新模型意外曝光:AI Agent才是未来~
据彭博社消息,中国AI新星DeepSeek计划年底发布对标OpenAI的AI Agent,能自主执行多步任务、自我学习进化。国内Kimi、Qwen也有相关动作,还分享了72多种高效AI工具。
Anthropic 完成930亿元 F 轮融资,投后估值达 13096亿
Anthropic 宣布完成由 ICONIQ 领投的 130 亿美元 F 轮融资,投后估值达 1830 亿美元。众多顶级投资机构参与,自推出 Claude 模型后增长飞速,业务覆盖多领域,资金将用于扩产、安全研究和国际化。