视觉神经增强」共找到 1090 篇相关文章

开源动态8

一行 Python,生成绝美城市地图海报!

开源君发现宝藏项目`prettymaps`,这是巴西开发者Marcelo Prates的开源作品,能从OpenStreetMap拉取数据画定制地图。它功能丰富,安装简单,可让普通人轻松进行地图视觉创作。

开源先锋
新闻资讯7

干掉 .md?兜里 Token 不够,没法和 Karpathy 共情

近日,围绕‘Markdown 是否已过时’讨论升温。Theo Browne 视频阐述‘HTML 优于 Markdown’五大理由并分享实操技巧,虽指出 HTML 有费 Token、版本控制差问题,但仍倾向用 HTML,不过也有开发者质疑。

InfoQ
算法论文8

超越Claude Mythos和GPT-5.5!斯坦福Agent验证框架拿下SOTA,Transformer作者转发

斯坦福、伯克利与英伟达联手打造LLM-as-a-Verifier验证框架,该方法是通用验证机制,可与任意Agent Harness和模型结合。研究表明扩展验证阶段计算量,能提升Agent整体性能,在多基准测试中超越Claude Mythos和GPT - 5.5。

量子位
产品应用8

Claude Opus 4.7发布:更强能力,自我纠错,越来越不需要人类干预了

Anthropic发布Claude Opus 4.7版本,搭配Routines功能可自动化工作,减少人类干预。该版本能力大幅增强,还引入新护栏机制保障安全,推出新运算级别和任务预算功能。

AIGC开放社区
开源动态8

解决VLA模型落地难,普通硬件也能跑!全透明全开源的高效VLA模型把推理成本砍掉76%

2026年4月,中山大学与MBZUAI联合推出A₁模型,它是完全开源透明、自适应高效的截断式视觉 - 语言 - 动作模型,能削减推理成本、实现低成本落地,在仿真与真机上表现优异。

量子位
新闻资讯8

5Y News | 华深智药完成7.87亿美元融资,刷新2026生物技术公司融资记录

华深智药近日完成7.87亿美元融资,由Dimension Capital等主导。其利用AI技术重新设计新药研发各环节,AI原生平台已有40多个研发项目。融资将助力推进药物研发,此前与赛诺菲合作价值超44亿美元。

五源资本 5Y Capital
开源动态8

开源音视频同步SOTA基座:极简的单流架构,2秒出片

AI视频生成迈入音视频同步新纪元,闭源巨头已展实力,而上海创智学院与Sand.ai联合发布的开源音视频生成基础模型daVinci - MagiHuman,以极简单流架构,2秒就能在1张H100显卡上生成精准音视频同步画面。

AIGC开放社区
算法论文7

引入小目标注意力模块改进YOLO12用于无人机视角下的岸边人员玩水检测

文章介绍用小目标注意力模块改进YOLO12,用于无人机视角下岸边人员玩水检测。先介绍YOLO12特点与结构,再说明小目标注意力模块CBAM优势、流程及代码,接着阐述改进方法、数据集情况,最后给出训练和测试模型的代码与结果。

机器学习AI算法工程
新闻资讯7

AI甚至开始抢土木老哥的工作了

即便土木、建筑等传统行业,也受AI冲击。建筑业用AI克隆老师傅、替代部分人力,如Procore推出多款AI智能体,Skanska建立AI安全智能体。建筑AI生态矩阵正形成,国内需相关工具。

新智元
产品应用8

阿里Qwen-Image-2.0图像生成与编辑巅峰汇合,超真实、超强图文结合

阿里Qwen - Image - 2.0将生图与编辑能力合二为一。它支持长指令,能精准渲染大量文字,引入物理逻辑让文字呈现真实质感,在生图和编辑上对语义理解和画面重构能力强。

AIGC开放社区