「几何学习框架」共找到 2800 篇相关文章
上科大何旭明团队新作:克服简单样本偏置,让多模态模型学会「难题优先」
上海科技大学何旭明团队针对多模态模型幻觉问题,提出DA-DPO框架。该方法不依赖额外人工标注,通过动态调整样本权重,缓解简单样本偏置,在降低幻觉率同时提升综合能力,具成本效益。
中科院首提「AI哲学」,万字解读:为自身立命,为AI立心
中科院吴怀宇教授首次系统性提出「AI哲学」体系,以「感智境行」为核心架构,探讨智能本质、人机边界等,为人类应对AI冲击提供认知框架,也为AI赋予意识根基,涉及多学科,具多方面价值。
实测谷歌AI故事书,我实现漫画和绘本自由了
谷歌Gemini推出免费StoryBook工具,30秒左右可生成10页故事书,支持中文且内容有趣。测试显示,它在图像风格、故事创作上表现出色,还能作学习和展示工具,获网友好评。
ACL'25 | CIGEval:一种基于多模态大模型的可控生图评测智能体
阿里国际AI团队提出CIGEval,这是基于多模态大模型驱动的图像生成评估智能体框架。它集成多功能工具箱,通过任务拆解与工具调度提升评估准确性与可解释性,已在ComfyUI - Copilot上线。
国产多模态Agent拿下医学分割SOTA!不用改模型、不加token | 浙大&上海AI Lab
现有医学多模态大模型在分割生物医学图像时存在瓶颈,浙大蔡钰祥教授、上海AI Lab江彦开等人提出IBISAgent框架,将分割定义为多步视觉决策过程,实验显示其在多数据集上大幅领先对比方法。
全球1100万台出货,追觅打造最聪明的扫地机
追觅扫地机将AI打造成完整链路,实现从感知到决策的闭环。其X60 Pro采用超广角双目灵动导航避障技术,提升感知能力,引入强化学习优化决策,全球出货超1100万台,营收增长显著。
迈向可编程观测:在GPU Kernel中构建类eBPF风格的性能探针
文章从CUDA基础讲起,以矩阵乘法为例介绍性能调优,再到PTX汇编知识,最后引入Neutrino框架构建可编程GPU性能探针。展示了GPU Kernel性能分析从宏观到微观的技术演进,提供新分析视角。
76%的性能提升与模型无关?Karpathy 700次 Loop 实验揭开 Agent 最大误区
前OpenAI联合创始人Andrej Karpathy警示业界重视模型框架。Hugging Face实验表明优化模型外层执行机制可大幅提升Agent性能,Karpathy开源项目揭示AI价值在循环迭代。还介绍了搭建持续进化Agent的方法及注意事项。
超越GPT-5.2和Gemini-3-Pro!商汤多模态搜索、推理模型开源
商汤开源多模态自主推理模型SenseNova - MARS(8B/32B双版本),它通过强化学习整合工具,在多模态搜索与推理测试中超越Gemini - 3 - Pro与GPT - 5.2,还采用创新算法稳定训练,构建新基准评测。
DeepEval:LLM 应用评测不再玄学,让大模型评测像写单元测试一样简单
在大模型应用开发中,科学、自动化评测 LLM 输出质量是难题,人工评测效率低。DeepEval 是 Confident AI 团队开源的 LLM 评测框架,能用极简代码让评测像写 pytest 一样自然,内置多种评测指标,支持批量评测等。