「云的形状」共找到 10903 篇相关文章
Fable5仅做对3.5%!大模型会看图,但还没有主动视觉
本文介绍了专门测量「主动观察」能力的视觉推理基准 ActiveVision,评测显示无外部工具时,大模型与人类准确率有近 9 倍差距,用工具后虽提升但仍远不如人类,还说明了其出题与避免取巧的方式。
【展讯】不止观看:澳门当代摄影展|三影堂北京
本次《不止观看:澳门当代摄影展》汇集孙彦等13位澳门艺术家的创作,他们突破传统影像边界,将澳门多元文化转化为视觉文本。展览作品探讨摄影与城市、文化、技术等关系,呈现从传统到AI的多元脉络。
这个开源项目把视频处理与投稿接成一条流水线
Y2A-Auto是面向YouTube、AcFun和bilibili的自动化处理工具,将下载、识别、翻译等操作集成到Web管理后台。用户可手动或自动处理,支持多平台投稿,有多种功能和灵活配置,适合持续处理授权内容的用户。
CRISPR之母杜德纳给硅谷泼冷水:AI还治不了病,创新仍然属于人类
CRISPR之母杜德纳在接受Bloomberg采访时,直言不认同硅谷‘人工智能将治愈一切疾病’的论点。她认为创新仍属人类,AI虽有用但难创新,且应用需正确数据。她还关注CRISPR疗法的应用与伦理问题。
14.8K Star!这个开源 Skill,一句话就能做出大厂级设计!
Anthropic 发布的 Claude Design 虽能在对话框生成网页,但需手动操作。有人据此开发了开源项目 Huashu Design,可在 agent 里打一句话,3 到 30 分钟就能拿到能交付的设计,还介绍了其功能、核心规则等。
ICML 2026 | 只用少量Thinking Tokens,大模型依然能深度思考
近年来,CoT 推理成为提升大模型复杂问题求解能力的重要路径,但带来效率问题。浙江大学等团队提出 Heima 框架,将冗长 CoT 压缩为少量 thinking tokens,在减少 token 数的同时保留推理能力,已被 ICML 2026 接收。
挑战扩散自回归统治!字节提出视觉生成第三种路线,让模型像人类一样边画边改
五一期间字节商业化技术团队研发出新一代视觉生成模型,其底层架构是全新的第三条路——生成精炼网络GRN。它能让AI像人一样边画边改,解决了现有模型的问题,在多项基准测试中刷新SOTA记录。
AI 时代到底该怎么管一个工程团队
Fiona Fung在Anthropic大会分享AI时代管理工程团队经验,指出软件工程瓶颈转移,需重构流程,介绍了少做和多做的事、技术辩论方式、代码评审分工等内容,还提及组织形态、指标及未解决的问题。
龙虾开始自己拍电影了:我在 LibTV 里看着它从一句话做到成片
作者试用 AI 视频产品 LibTV,仅给 Claude Code 发一句话“「黑神话哪吒」视频制作”,约 10 分钟就得到视频初稿。LibTV 能搭好 0 到 60 的地基,留下可继续创作的画布,成本低还能多尝试,最后仍需人把关。
开源安全工具 Trivy 遭供应链攻击,引发行业紧急响应
开源漏洞扫描工具 Trivy 遭供应链攻击,恶意版本 v0.69.4 含外传敏感数据代码,通过正常渠道传播。攻击者利用攻破的凭证操控发布流程,影响或扩大,维护团队已采取措施,引发行业对开源工具信任边界的讨论。