「K2.6」共找到 2782 篇相关文章
AI“租人”平台一夜爆火:时薪3500、2.4万用户抢着“卖身”,专家:警惕劣币驱逐良币
RentAHuman.ai网站上线,让AI可通过接口雇佣人类执行线下任务,上线一天访问量破50万,超2.4万用户“挂牌待租”。该模式引发热议,专家认为其凸显Agent“存在感”,但只是阶段性方案。
ECCV 2026 | 智能助手何时该主动开口?Vinci2让第一视角AI助手从「有问必答」走向「主动服务」
现有第一人称视频助手难以自主判断何时介入服务用户。大连理工大学等团队提出Vinci2,含评测基准EgoServe和智能体EgoMemo。它已被ECCV 2026接收,代码和标注均开源。
突破显存瓶颈:基于 DeepSeek-V3.2-Exp 的 Latent Cache 卸载预取方案设计与模拟验证
百度百舸AIAK团队针对DeepSeek-V3.2-Exp,设计基于Latent Cache的卸载预取方案ESS。该方案解决显存瓶颈,提升Decode吞吐并降低成本,经模拟验证效果显著,未来将拓展应用。
Claude Opus 4.6差评如潮!思考深度暴跌67%,AMD总监6852次日志打脸
Claude Opus 4.6遭差评,用户感其「变笨」,输出浅、易失败、违规提示增多。AMD总监用6852次日志证明其「思考深度」降67%,价格高却性能倒退。Anthropic虽称优化,但用户不满默认值被改。
GLM-5.2真正的跨越:CritPt密闭物理数据集测试得分20.9%,打平Opus-4.8
GLM - 5.2在CritPt密闭物理数据集测试中表现亮眼,与Claude Opus 4.8得分并列,远超其他开源模型,还击败多款闭源模型,实现4.5倍代际飞跃,标志开源模型科学推理能力进步。
一边秀肌肉,一边设围墙,NVIDIA 发布 OmniVinci,性能碾压 Qwen2.5-Omni,却被骂“假开源”
NVIDIA 推出多模态大语言模型 OmniVinci,结合架构创新与数据合成流水线,训练 token 仅为 Qwen2.5 - Omni 的六分之一,却在多项基准测试表现更佳。但采用限制商业用途的许可证,引发争议。
GPT-5.6 Sol首批内测结果来了!同任务成本只有Fable 5一半
GPT-5.6 Sol预览版发布半月,首批内测报告出炉。它代码简洁,适合长链路任务,视觉效果好。虽整体略逊Fable 5,但成本近乎减半,且安全限制小,即将全量上线。
从分钟级等待到20倍超速:LightX2V重写AI视频生成速度上限
今年,开源项目LightX2V在ComfyUI社区走红,单月下载超170万次。它是面向低成本、强实时视频生成的推理技术栈,能在消费级显卡上高效生成视频,还支持多种模型和硬件,覆盖不同用户需求。
又一个Kimi K3下周开源!Qwen3.8-Max编程、办公、科研都能自己干了
Qwen3.8-Max是Qwen家族迄今最强模型,2.4万亿参数,下周将开源权重。它在多项基准测试中表现出色,能连续自主工作数天,在编程、办公、科研、长周期任务、多模态等方面全面提升。
把大厂 10 年的职场经验,做成了一个「Coze Skill」—— 扣子 2.0 深度实测
作者实测扣子 2.0,介绍其「技能商店」功能,可将专家方法论封装成技能供调用。通过简历诊断、画架构图、生成 GEO 稿件三个场景展示提效作用,还提及「长期计划」功能,称扣子定位职场 AI,降低使用门槛。