「面壁智能MiniCPM-V 4.5」共找到 3287 篇相关文章
刚刚,蝉联Future X全球榜首的MiroMind发布全球最强搜索智能体模型
由陈天桥和代季峰联合发起的 MiroMind 团队,于 1 月 5 日发布自研旗舰搜索智能体模型 MiroThinker 1.5。该模型参数规模小但性能强,其核心是「发现式智能」理念,还采用了新训练技术,有 A 股涨停板预测等应用。
时隔六年,OpenAI 为什么再次开源?
OpenAI发布两款开源纯文本推理模型,时隔六年再次开源。其gpt - oss - 120b性能与o4 mini相当,成本降超10倍。此次开源有战略考量,或是为构建生态、吸引企业,也反映出其对自身价值定位更清晰。
刚刚,DeepSeek又探索新架构了,开源OCR 2
DeepSeek更新DeepSeek - OCR 2,引入DeepEncoder V2架构,实现视觉编码范式转变。模型和技术报告齐开源,在多项测试中表现出色,降低重复率,为全模态编码提供路径,但在报纸类文档识别有不足。
硅谷陷入了对中国的痴迷与羡慕
《纽约时报》称‘硅谷陷入对中国的痴迷与羡慕’,虽有夸张,但中国在AI、基建等领域进展显著,如通义万相2.5视频大模型。a16z风投公司表达焦虑,中美科技竞赛激烈,双方开始相互学习。
Claude 活动上这台巴掌大的电脑,被玩疯了
上周Anthropic在开发者大会上,让参会者用Claude Code为巴掌大的M5Stack Cardputer ADV写程序,会后官方展示五个小项目,如摇一摇切换MacBook模式、拼写游戏等,代码开源,设备可带回家。
“龙虾”也需要看病?一张旧病历,引出三个新确诊
本文是悟空Agent泛化能力系列先导篇,以OpenClaw项目为例,介绍其通过不同泛化策略发现三个新漏洞,还总结实践原则。强调研究泛化能力对防御漏洞的重要性,4月底悟空Agent将开放试用。
语音模型也能“freestyle”?可定制角色,模拟背景音
阿里新推两款语音模型,Fun - CosyVoice3.5可基于参考音频克隆声音,优化多方面能力;Fun - AudioGen - VD能进行‘从无到有’音色设计,并模拟复杂听觉环境。用户即日起可在阿里云百炼调用。
用第一性原理超越AlphaFold:告别蛋白质工程的「碰运气」时代
在‘AI生物制造专场’中,杨晓锋副教授指出AI4S重塑蛋白质全生命周期,但面临维度鸿沟挑战。其认为AI需有外推能力,还展示可切割自聚集标签法简化流程,推动生物制造发展。
国产芯片也能跑AI视频实时生成了,商汤Seko 2.0揭秘幕后黑科技
自Sora 2发布,科技厂商掀起视频生成模型竞赛。12月15日商汤上线Seko 2.0,实现AI短剧‘一人剧组’。其背后的LightX2V框架做到实时生成,还适配国产芯片,有望推动视频创作生产力革命。
AI消灭感冒被提上日程,Anthropic和OpenAI罕见联手
全球支付巨头 Stripe 投资 5 亿美元建立非营利组织 Intercept,目标是解决呼吸道感染问题。Anthropic、OpenAI 等机构和个人也参与支持。Intercept 从广谱预防药物和空气净化杀菌技术两方面着手,科技公司也将提供技术助力。