视觉知识」共找到 1118 篇相关文章

新闻资讯7

Qwen最新3.7 Max预览版空降!两代超大杯并行迭代,林俊旸走了但还在加速

Arena公布Qwen3.7-Max-Preview和Qwen3.7-Plus-Preview成绩,文本和视觉领域均为国产第一。Qwen3及以后迭代提速,大版本间隔缩至2-3个月,反映阿里Qwen团队进入快速实验、高频交付阶段。

量子位
推荐文章7

一个Markdown就是一名员工!YC CEO给年轻人的忠告:现在一个人能顶400人,大厂中层最该被AI替换

YC总裁Garry Tan在深度对谈中表示,传统SaaS模式或失效,个人开发者效能因AI提升。他强调创业别追热点,应关注兴趣与独特知识,还指出大公司中层官僚体系未来可用Agents替代。

AI科技大本营
产品应用7

实测Claude Opus 4.7,好好的模型也开始不说人话了。

作者实测Claude Opus 4.7,它已全渠道上线,价格不变。该模型有多处更新,如隐形涨价、视觉能力提升、审美进步,但也出现不说人话的问题,还新增了effort档位、/ultrareview命令和Cyber Verification Program。

数字生命卡兹克
开源动态8

刚刚,杨植麟亲自开源Kimi K2.5!国产大模型打架的一天

今天国产大模型热闹非凡,Kimi更新至K2.5版本。它是万亿参数的MoE基础模型,开源且在多项评测表现佳,视觉与编码能力强,还引入Agent Swarm功能,实测展示其解决各类复杂任务能力。

机器之心
开源动态7

Google Design.md:一键复刻60+大厂设计规范 | 设计界的事,能叫偷吗?

今天分享Google Stitch团队提出的DESIGN.md标准,单文件搞定网页设计。62个真实网站视觉语言对应的DESIGN.md可在https://getdesign.md/获取,它也是开源项目。放入项目根目录后,AI编程助手可读取生成风格一致的UI组件。

AI进修生
产品应用8

真正的一句话修图:Gemini 用香蕉模型给出了图像生成的分水岭

Google新模型Gemini 2.5 Flash Image可在AI Studio体验。它有多图融合、角色一致性等能力,能实现自然语言编辑图像,速度快、价格低、API可用,虽有中文体验等问题,但有望让AI视觉工具进入工程化时代。

MacTalk
新闻资讯7

组织也能fork?Karpathy提出"代码即公司"

Karpathy提出“代码即公司”观点,认为AI驱动的组织可像代码仓库一样被复制、修改、迭代。传统组织因“制度性知识”难以fork,AI能将隐性知识显性化。交易公司或成首个被fork的组织类型,管理协调是核心竞争力。

AI工程化
新闻资讯7

不止萌兔蹦迪!狸花猫竖中指,吃奶婴儿开飞机,魔性AI视频让人停不下来

AI正席卷短视频,从“兔子蹦床”到“婴儿开飞机”,魔性剧情吸睛又迷惑,背后是算法驱动的流量生意。虚假内容泛滥,4大YouTube频道已全面AI化,“AI垃圾”或已暗中攻占人类心智,是时候普及“AI防诈”知识了。

新智元
产品应用8

豆包的新身份曝光:在国际艺术展当起了“AI讲解员”

文章讲述作者在浦东美术馆「AI与艺术」豆包讲解体验日活动的经历,实测豆包作为AI讲解员的业务水平,如筛重点、实时讲解、补知识,还揭秘其靠豆包大模型1.8的多模态处理等能力任职。

量子位
算法论文8

上海AI Lab提出CANON:让RLVR自主识别优质推理模式

上海AI Lab与上海交大团队提出创新框架CANON,解决将人类先验知识融入RLVR训练的难题。它通过条件分组与对比机制,自适应放大有益指标变化趋势,在数学和逻辑推理任务上成果卓越,还能提升推理效率。

深度学习自然语言处理