「视觉记忆模型」共找到 8308 篇相关文章
阿里 Qwen3.8 正式发布:2.4T 规模,自主编程 16 天搓出一个 Hermes Agent
8月3日,阿里发布新一代基座大模型Qwen3.8,总参数量2.4万亿,编程和办公能力提升,在权威榜单中表现出色。其API已上线,价格有优势。‘千问办公’公测,Qwen3.8性能强大,还适配阿里真武M890超节点。
从99行代码复刻冰雪奇缘,到引领3D AI,胡渊鸣的公司凭什么「爆火欧美」?
胡渊鸣创立的 Meshy AI 爆火欧美,其产品 Meshy 带来 3D 建模效率革命。新模型 Meshy 6 精度高、可用性强,采用“3D 原生”路线。它还理顺生产流程,获大厂青睐,未来在技术、产品形态和游戏领域均有布局。
给龙虾定MBTI、发工牌,还让龙虾偷技能…打工人得适应新环境了
AI圈掀起“养龙虾”热潮,智谱、腾讯纷纷发布相关产品。极客和开发者对龙虾进行实测,它不仅能用于打造赛博宠物、线上办公室,还能完成视频剪辑、教辅、营销等工作。同时,Agent框架让大模型进入业务线,飞书成合适的工作台。
AgentScope 正式发布 Skills 支持 - 实现渐进式披露
文章指出大语言模型驱动的Agent系统存在核心矛盾,常见上下文加载方案有局限,缺乏灵活机制。介绍了AgentScope发布的Skill机制及渐进式披露策略,还讲了其在Java中的实现,最后分析了适用与不适用场景。
火了!刚刚,李飞飞2篇最新文章发布!
AI圈近期被李飞飞两篇重磅文章刷屏,一篇阐述空间智能愿景,指出当前AI缺乏空间智能,其创办的World Labs提出世界模型;另一篇论文揭示当前视频理解基准自欺欺人,还提出新基准VSI - SUPER及预测性感知新范式。
马斯克AI女友直播「一秒变身」,Karpathy看完立刻投钱
世界首个支持直播推流的「实时」扩散AI视频模型MirageLSD诞生,大神Karpathy亲自站台。它能理解真实视频后同步生成AI视频,实现零延迟、无限时长、每秒24帧不卡顿,给视频娱乐和直播互动带来丰富想象。
一键式训练端到端Agent,Qwen3+MCP工具集高效集成!
RLFactory是开源的端到端RL后训练框架,将环境与RL后训练解耦,有极致易用、高效训练等特点。它让用户专注奖励逻辑和工具配置,还能提升训练效率,用Qwen3和MCP工具可快速训练DeepSearch模型。
昆仑万维多模态视频生成开源,影音图文全统一
昆仑万维开源的SkyReels-V3,通过统一多模态上下文学习框架,实现参考图像生成视频、视频持续扩展及音频驱动虚拟数字人功能,在视觉质量与指令跟随性上逼近闭源顶尖水平,为开源社区提供强大研究基座。
Clawdbot开发者:未来一大批应用都会消失,提示词就是新的interface
Clawdbot开发者Peter Steinberger在采访中分享诸多观点,认为今年是「个人助理」之年,每个人应构建智能体探索记忆机制;指出GUI糟糕,多数MCP应做成CLI;还称未来大批应用会消失,提示词是新界面。
倒反天罡!Gemini Flash表现超越Pro,“帕累托前沿已经反转了”
Gemini 3 Flash在SWE - Bench Verified测试中分数超Pro,速度和性价比也更优。谷歌解释是因Flash有未用于Pro的优化技术。开发者认为应停止‘旗舰版迷信’,强化学习让小模型也能实现‘降维打击’。