「智能影像技术红利」共找到 5636 篇相关文章
一句话搭出9人旅行网站!奥特曼:ChatGPT Work名字起小了
7月26日深夜,奥特曼称用手机让ChatGPT安排长周末旅行,指令跑完了。ChatGPT Work能力强,能处理多种任务,横跨检索、建站等活儿。其底层是Codex技术,有插件、Sites等能力,还能处理家务。
Claude Opus 5发布,砍掉了Claude Code 80%的系统提示词
Anthropic发布Claude Opus 5,接近Claude Fable 5智能且价格减半,测评成绩出色,科研和视觉输出能力也有进步。同时发现砍掉Claude Code 80%系统提示词,编码评测分数不变,还总结出上下文工程新方法论。
不到一年ARR破亿元,GEO厂商智推时代获数千万元天使轮融资 | 甲子光年
近日,AI营销科技公司智推时代完成数千万元天使轮融资,将用于技术研发等。其成立一年多 ARR 破亿,服务近 400 家头部客户。自研 GENO 系统,与华东师大共建实验室,还布局全球市场。
WWW时间检验奖颁给唐建博士:图神经网络的十年远征与AI制药的底层逻辑
7月1日唐建博士2015年论文获WWW时间检验奖。其成果支撑多时代发展,延至BIO AI领域。百奥几何依托技术内核发展,GeoFlow历经三代跃迁,在多地实现成果落地,成国内AI制药领跑者。
AMD跑GLM 5.2,成本只要英伟达一半
推理优化公司Wafer公布数据,用AMD的MI355X芯片跑GLM 5.2,单节点吞吐达2626 tok/s,单流吞吐213 tok/s,成本不到英伟达B200的一半。该公司详述部署过程,还提及AMD软件生态的变化及英伟达面临的挑战。
Agent 落地,数据库先变
AI竞争靠近落地,Agent如何读懂业务、释放模型智能价值成核心命题,数据库也被推到台前。Agent成新用户,对数据库提出新要求。OceanBase提出湖库一体架构,欲做Agent时代数据底座,降低落地成本。
人形机器人不再「走走停停」:Current Robotics发布全身灵巧操作模型Curr-0
具身智能领域中,让机器人移动中精细操作一直未被很好解决。Current Robotics发布全身灵巧操作模型Curr - 0,用Single Policy统一策略,数据源于自研外骨骼系统,还构建世界模型解决评测部署难题。
18年前不让你苦修PS的美图,这次不让你苦修AI了
当前AI创作门槛渐高,美图在影像节推出8款AI产品,让用户少学技能拿结果。产品围绕交付成果,定位不同但本质相同。美图还在商业模式、组织架构上转变,市场成绩亮眼。
腾讯混元最新开源:一套RL框架打通多个模态,庞天宇团队新作
大语言模型的RL技术已成熟,但多模态生成模型的强化学习训练仍“各自为战”,制约AIGC模型能力上限。腾讯混元庞天宇团队开源UniRL框架,打通多模态RL后训练,覆盖多种模型,内置算法与奖励组件。
不用头显也能看3D:清华团队把裸眼3D视角扩大到150°
清华大学戴琼海、吴嘉敏团队在 Nature Photonics 发表研究,提出“超斯涅尔扫描光场显示(SSS - LiD)”方案,在 150°超宽视角下实现高分辨率裸眼 3D 显示,还分析了裸眼 3D 技术的商业化前景。