「AI协作体系」共找到 10114 篇相关文章
Jina-VLM:可在笔记本上跑的多语言视觉小模型
Jina AI 发布 2.4B 参数量的视觉语言模型 Jina-VLM,在多语言视觉问答任务达 SOTA。它引入注意力池化,连接视觉与语言基座,支持 29 种语言,能高效处理问答等任务,对硬件需求低。
轻量级易开发,8B参数释放大实力!科学多模态模型Intern-S1-mini开源
上海人工智能实验室继7月26日开源后,推出轻量化版本Intern-S1-mini。它是8B参数“迷你模型”,兼具通用与专业科学能力,适合快速部署和二次开发,在多方面表现出色,还降低了对高端计算设备依赖。
一场实战派圆桌实录:解码严谨行业智能体落地的硬核突围|甲子光年
2025年7月28日,在世界人工智能大会相关论坛的圆桌对话里,来自不同行业的实战派探讨企业级AI智能体落地。他们分享落地踩坑经验、应对数据等问题的办法,还预测了未来智能体大规模应用的行业。
TACL 综述 | 别只卷架构了——长文本模型的能力天花板,其实是数据决定的
该 TACL 综述首次从数据视角审视长上下文语言模型,指出长上下文能力本质是数据驱动。它建立分类体系,明确高质量长文数据条件,给出核心能力的数据配方与评估法,还整理数据集和基准,提出待解问题。
Jeff Dean最新访谈:基础模型越来越强,小团队如何与谷歌等巨头竞争?
Jeff Dean 在 Y Combinator 活动中与 Diana Hu 对谈,探讨 AI 创业者面临的问题。他指出推理成新瓶颈,预计有更多推理硬件;Agent 执行复杂任务进步快;小团队可找 1%成功率问题;还提及稀缺能力及创业建议。
挤干大模型高分「水分」!最强模型仅49分,南大傅朝友发布Video-MME-v2
南京大学傅朝友团队在 Google Gemini 评测团队邀约下推出视频理解新基准 Video-MME-v2。它有创新的分层能力体系与组级非线性评分,揭示模型与人类的巨大鸿沟、传统 Acc 指标虚高、“Thinking”并非总是增益等现象。
5万人抢光「阶跃龙虾」:3分钟一键部署,「养虾」终于变简单了
3月12日「阶跃龙虾」上线,提供5万个免费体验名额。此前阶跃星辰自研的Step 3.5 Flash模型在OpenRouter平台霸榜。其一键部署功能简化养虾流程,且云端版本支持7×24小时在线,国产厂商正推动AI Agent使用范式转变。
焦虑的贝索斯,决定先裁30000人
亚马逊启动史上最大裁员,先裁14000人,明年或再裁。表面因疫情后人员冗余,实则源于AI军备竞赛压力,AWS优势缩小。公司还计划用机器人替代超50万员工,中层和初级岗位受冲击大,H - 1B员工处境艰难。
12.1万高难度数学题让模型性能大涨,覆盖FIMO/Putnam等顶级赛事难度,腾讯上海交大出品
腾讯AI Lab与上海交大团队联合推出首个基于自然语言的数学定理证明框架与数据集DeepTheorem。12.1万道高难度数学“特训题”让模型定理证明性能大涨,7B模型性能比肩或超越现有开源和商业模型。
10w人看过的龙虾量化系统,评论区骂最多的问题,我花2天补上了。
上一篇龙虾量化系统文章获10w+,评论指出数据是短板。作者经研究找到QVeris,它是统一数据接口平台,使用简单。作者以金融领域为例介绍其用法,还测试其在其他领域的能力,认为它是AI时代的数据基础设施。