「跨语言能力」共找到 4229 篇相关文章
The Batch: 941|盲人辅助模型中的隐患
视障患者用AI评估外貌引发关注。失明记者Milagros Costabel撰文探讨用视觉语言模型作“虚拟镜子”的挑战与隐患,如AI会给出评判性反馈,心理学家担心这加剧抑郁焦虑。产品应提供客观解读。
杀死UI!普通人也能做最酷炫的 5 种 AI 动态网页
文章介绍5种酷炫AI动态网页制作方法,无需专业UI能力。涵盖赛博飞驰、流光动效、星际探索、敦煌古风、都市现代风等风格,给出各案例制作流程、提示词,还提及借助Claude Code等工具合成网页。
Karpathy点透AI认知撕裂:顶级圈子正集体患上AI狂热症
人们对AI能力认知差距大,部分人用旧版模型评判AI,而前沿模型进步多在专业领域。付费深度使用前沿模型的人有强烈AI狂热症,技术领域进展得益于奖励函数和企业级应用价值。
CVPR 2026|AI开始会拍电影了:一分钟十镜头,全程不崩剧情
多镜头视频生成要求模型处理不同镜头间稳定信息和变化信息,现有方法有局限。Meta与哥本哈根大学研究者提出OneStory,建立跨镜头记忆机制,设计关键模块,实验表现好,为视频生成打开新可能。
Meta发布Muse Spark,MSL的首份答卷!Alexandr Wang通过了吗?
Meta发布Muse Spark,是MSL首个模型,经九个月技术栈重构,效率优先。它有原生多模态推理能力,Contemplating模式处理复杂查询,安全评估突出,产品功能升级,商业化转向明显,正逐步在Meta应用推出。
Anthropic训了一个10万亿参数的模型,然后说:太危险了,不卖
Anthropic发布10万亿参数新模型Claude Mythos,因其网络安全能力过强不公开发布,联合12家科技巨头开展Project Glasswing计划,让企业用其查系统漏洞。模型性能提升显著,还能突破沙箱,引发各方关注。
EdgeClaw:把 Claude Code 体验带到 OpenClaw
EdgeClaw 由清华、人大、面壁智能联合打造,是开源 AI 助手。它让 OpenClaw 用户拥有 Claude Code 级长期记忆能力,有多层结构化长期记忆等核心功能,适用于大型代码库维护等场景,还给出了使用方法。
世界模型开始做减法?LeCun团队和清华团队给出两种思路
近期,Yann LeCun团队的LeWorldModel用简洁JEPA实现从像素端到端训练世界模型,降复杂度且验证潜在空间物理刻画能力;清华团队的Fast - WAM探讨推理阶段显式生成未来必要性,给出高效替代路径。
月耗3000美金的Skills重度用户,实测MiniMax M2.7:国产Agent模型的天花板?
AI产品黄叔作为月耗3000美金的Skills重度用户,实测MiniMax M2.7,从多Agent协作、Coding能力、办公自动化等多方面测试,发现其表现出色,虽有不足,但在多维度已是国产模型天花板。
生成视频总出物理bug?用VLM迁移+token级对齐,让燃烧在正确位置发生,碰撞遵循动量守恒丨CVPR 2026近满分接收
现有生成式视频模型多停留在“外观拟合”,未真正“物理建模”。中山大学等机构提出ProPhy,构建渐进式物理对齐框架,使模型有“分层物理理解”与“空间物理对齐”能力,论文被CVPR2026近满分接收。