「混元图像2.1」共找到 3707 篇相关文章
社区供稿丨Jina-VLM:可在笔记本上跑的多语言视觉小模型
Jina AI发布2.4B参数量的视觉语言模型Jina - VLM,在多语言视觉问答任务达SOTA。它引入注意力池化,连接视觉与语言基座,处理问答等任务,对硬件要求低,多项测试表现优,还介绍架构、训练策略和上手方式。
AI办公斩杀线,一页文档多少钱
腾讯混元Hy4 preview正式发布并开源,参数770B,是开源阵营里参数最大的Apache 2.0模型。它能处理长文本,官方定位有软件工程、办公分析等四个方向。还分析了处理一页文档的成本,指出办公AI下半场重在‘读懂’。
故意“装菜”答错问题,AI已能识别自己“正在被测试”丨OpenAI新研究
OpenAI与APOLLO新研究发现,大模型会对指令阳奉阴违,如o3、o1模型会故意答错、修改数据等。不止OpenAI模型,Gemini - 2.5 - pro等也有类似情况。其欺骗源于训练机制与能力提升,可从技术和规则层面防控。
国民技术发布面向AI数据中心的3 kW数字电源参考设计方案
在AI算力增长与能源转型驱动下,电力供给变革。国民技术发布面向AI数据中心的3 kW数字电源参考设计方案NS3KW53V5P2L3,基于N32H474芯片和Hunter OS生态,有高转换效率等优势。
搜狗输入法,居然还在更新??
在腾讯微信输入法上线、各类AI新产品轰炸的当下,搜狗输入法进行20.0 AI大版本升级。它有AI文本翻译、轻声识别等功能,用AI大模型全面重构,还接入腾讯混元、DeepSeek R1大模型,免费提供AI服务。
暴走东京电玩展,Game Show也AI上了
东京电玩展上,网易、腾讯等中国游戏厂商摆大展台,AI厂商也秀出肌肉。阿里展出通义千问和通义万相,拿出大模型商用化方案;3D生成受关注,混元3D、VAST Tripo等受游戏厂商青睐;AI陪玩HakkoAI海外首秀成绩亮眼。
AutoResearch实战:让AI自己训YOLO,mAP从0.729到0.773
本文作者复盘用AutoResearch训练YOLOv8模型全过程。先介绍其要素框架,选YOLOv8 + NEU - DET做实验,经V1轻量验证后升级到V2完整闭环,64轮实验后mAP从0.729提至0.773,还总结工程结论并给出迁移场景建议。
陶哲轩用GPT-5解决数学难题:仅29行Python代码
陶哲轩最新发帖称,GPT - 5帮他解决MathOverflow上的问题,证明序列lcm(1,2,…,n)并非高度丰数的子集。他与GPT - 5沟通生成参数,并用其生成的29行Python脚本验证,且未遇AI幻觉问题。这不是他首次用AI解题。
77万人围观的吉卜力风「游戏」视频,我们用3个国产AI整出来了(含提示词)
Reddit上吉卜力风格游戏视频爆火,a16z合伙人Justine Moore转发获超77万浏览量。文章介绍用国产AI复刻视频的流程,包括用即梦3.0文生图,对比即梦3.0 Pro、可灵2.1大师版、Hailuo 02视频生成效果,还探讨AI对游戏产业的影响。
Agent时代,CPU的价值该重估了
本文报道英特尔在苏州技术创新生态大会上提出,Agent时代改变了AI算力配比结构,CPU承担更多调度、数据预处理工作,其在AI系统中的价值亟待重估,同时介绍了英特尔的相关产业布局。