「架构图」共找到 2068 篇相关文章
看傻了!5k Star Canvas Editor,我被惊到啦~~~~
Canvas Editor是基于HTML `<canvas>` API的文档编辑器,自己控制绘制、分页、交互和导出。文章介绍其与普通编辑器差异、核心能力、适用场景、接入代码,也指出项目限制,认为它是架构新选择。
从Foundation Model到Physical AI,三星「杀入」大模型核心战场
三星正快速进入大模型核心战场,构建Foundation Model体系,采购GPU用于AI基建。它提出Meki架构、M2RL训练范式和LiveClawBench评测体系,由AI Model TF团队推进,负责人是唐业辉。
CVPR 2026 | BiMotion:用 B 样条曲线重新定义 3D 角色运动生成
爱丁堡大学等团队提出 BiMotion 框架,将在 CVPR 2026 发表。它用 B 样条曲线表达运动,解决现有方法问题,有独特架构和损失函数,实验表现优,代码和数据集已开源。
解决特斯拉「监督稀疏」难题,DriveVLA-W0用世界模型放大自动驾驶Data Scaling Law
自动驾驶领域VLA大模型面临‘监督稀疏’难题,特斯拉公布此挑战。DriveVLA - W0研究提出用世界模型解决,将‘预测未来图像’作自监督训练任务,还提出轻量级架构降低推理延迟。
算法与我们:谁在驱动极化?
荷兰阿姆斯特丹大学论文《我们能修复社交媒体吗?》借助AI模拟无算法社交平台,发现三大乱象迅速复现,干预收效甚微。指出问题根源或在社交底层架构,用户可改变分享模式。
ICLR 2025新成果:文档检索“降本增效”,从此“开挂”
传统文档检索系统处理视觉信息丰富的文档存在瓶颈,ColPali方法直接从文档页面图像生成多向量嵌入,简化流程、提高性能、降低延迟。ColQwen - Omni在其架构上扩展到图文+音频多模态匹配。
蒙娜丽莎让大模型们几乎全军覆没!网友:懂了,AI不会眯眼睛
日本艺术家北冈秋吉创作的蒙娜丽莎图难倒一众大模型,ChatGPT、Gemini等表现不佳,国产玩家如豆包等也有判断失误。不过o3 - Pro一次性答对,GPT - 4o尝试三次猜对。
Correlations:氛围测试你的向量模型
Jina AI分享内部调试可视化向量小工具Correlations,它能生成交互式热图展示内容间余弦相似度,提供多种交互方式。工具已在GitHub开源,适用于内容去重、验证引文等场景。
谷歌发76页智能体白皮书!你的「AI替身」已上线
谷歌发布76页AI智能体白皮书,剖析其应用前景。涵盖智能体运维、评估方法,探讨多智能体架构,还介绍智能体增强检索生成及企业应用,如NotebookLM企业版、Agentspace空间企业版等。
别再让语音机器人“答非所问”:AI Force任务型语音对话技术总结
本文围绕企业级任务型语音Agent核心挑战,提出解决“拟人化”与“专业化”问题。介绍三段式语音对话解法、架构演进,还提及‘衍算’推理框架等技术及未来方向,团队来自蚂蚁集团AI force。