「物理场景测试」共找到 3834 篇相关文章
开源AI真人级互动老师,多Agent+可视化画布,函数/思维导图实时作图!
本文介绍开源项目ChatTutor,它是可视化互动式AI老师,能边说边画。有数学画布、思维导图等功能,未来将支持代码、物理等画布,可用于解题、备课等,已上线chattutor.app。
AI秒破18世纪「天书」账本!谷歌新模型盲测刷屏全网
谷歌AI Studio上一神秘模型引发关注,它识别200多年前商人的「天书」账本,修正格式错误与模糊表述,推理能力令历史学家震惊。该模型解决手写识别和推理两大难题,或为谷歌将推的Gemini - 3。
AI Code赛道跑出一匹黑马:字节Doubao-Seed-Code
字节发布面向Agentic Coding任务优化的编程模型Doubao - Seed - Code。它在代码能力、生态兼容性、价格上优势明显,在实际案例中表现出色,其训练体系独特,为开发者提供高性价比选择。
谢赛宁、李飞飞、LeCun联手提出多模态LLM新范式,「空间超感知」登场
纽约大学助理教授谢赛宁与李飞飞、Yann LeCun 合作提出「Cambrian - S」,迈出视频空间超感知探索第一步。该研究引入 VSI - Super 基准,还提出预测性感知范式,在空间认知任务上有提升,相关论文值得视频多模态研究者参考。
AI 智能体未来之争:是迷你应用(GPTs)?还是模块化代码(Skills)?开发者,你站哪边?
Anthropic 公布全新 Skills 功能,让开发者可通过模块化组件扩展 Claude 能力,功能覆盖网页、代码环境及 API 接口。它与 OpenAI 的 GPTs 等不同,更强调透明可审计,受开发者称赞。
Midscene.js 实战与源码剖析:如何重塑 UI 自动化
本文介绍Midscene.js这款基于AI的下一代UI自动化工具,剖析其设计动机、架构、原理及源码,结合业务场景分享问题与思考,还对比类似工具,给出试用配置和使用建议。
GraphRAG,这次被G-Reasoner统一了
大语言模型在知识密集型任务中存在局限,GraphRAG 也有迁移难题。G - Reasoner 提出统一框架,含 QuadGraph、GFM、LLM 增强推理模块,在性能、泛化、效率上全面领先现有方法。
开源共建重塑推理 Infra:从架构创新到生态协同,Mooncake的破局之路
大模型推理落地面临成本、吞吐、长上下文“三角困境”。开源项目Mooncake以“计算存储解耦”为核心,通过PD分离等技术提供底层支撑。直播邀请专家从多视角拆解其技术逻辑、开源价值与企业实践。
中国移动副总经理陈怀达:AI时代,真正的竞争力不在于单一技术的领先
10月19日,中国移动副总经理陈怀达在2025世界VR产业大会演讲指出,VR与AI深度融合,‘AI+’时代有‘三个加速融合’趋势。他还提出关注方向,分享了中国移动‘VR+AI’融合发展体系实践。
Embedding黑箱成为历史!这个新框架让模型“先解释,再学Embedding”
来自多高校研究人员推出可解释的生成式Embedding框架GRACE,解决传统文本表征模型黑箱式表征瓶颈。它重新定义对比学习信号,含三个关键模块,训练双模式统一,实验跨任务提升且不损生成能力。