「可交付设计稿」共找到 5075 篇相关文章
ICML 2026 |让大模型边想边说:这篇文章把「何时开口」变成可学习策略
论文《When to Think, When to Speak: Learning Disclosure Policies for LLM Reasoning》针对推理模型的‘沉默税’问题,提出Side - by - Side(SxS)Interleaved Reasoning,将‘何时披露内容’变为可学习决策,经实验验证效果良好。
刚刚,谷歌摊牌:Genie 3让你1秒「进入」名画,人人可造交互世界!
谷歌新发布Genie 3世界模型,能从文本生成交互式AI空间世界,操控图像和视频。用户可进入《苏格拉底之死》《夜游者》等名画探索,还能利用它训练3D模型,实现沉浸式体验。
商汤新模型 SenseNova-U1 Pro 曝光,对标 GPT-Image-2,瞄准「设计」赛道
商汤科技在股东大会预告下一代旗舰多模态基座模型 SenseNova-U1 Pro,预计 2026 年 7 月邀测,对标 GPT-Image-2,瞄准「设计」赛道,具备多核心能力,还支持 8K 分辨率输出。
不用抗生素也能抗菌!AI设计新型蛋白质抵御细菌耐药性|Nature子刊
澳大利亚研究借助AI工具设计出能与ChuA结合的蛋白质,抑制大肠杆菌等细菌生长。这些蛋白质像“分子锁”,阻断细菌获取血红素,降低耐药风险,开创“非抗生素”抗菌新范式。
前百川智能联创焦可新创业公司曝光,新项目已上线 App Store
前百川智能联创焦可新创业公司曝光,其推出的AI语音产品“来福”已上线App Store。该产品定位AI语音电台应用,探索声音交互场景,目前仅邀测。国内大厂未推专注AI播客独立产品。
快手可灵也吃上了香蕉,一通离谱prompt测试,好好玩要爆了
ChatGPT发布三周年,快手可灵AI视频「O1模型」登场,号称“全球首个统一多模态视频模型”。实测显示它能一站式搞定视频修改、镜头延展等操作,还推出了图片O1模型,在图片生成方面表现出色。
AI 创业者想出海拿美元,搭好可融资的企业架构才是第一步
本文围绕AI创业者出海搭建可融资企业架构展开。指出投资人投的是公司而非产品,介绍美国常见实体类型及适用场景,还谈及股权分配、董事会架构设计,以及中美创投实践差异,给出相关建议。
开源版Genie 3世界模型来了:实时+长时间交互,单卡可跑,国内公司出品
本月初 Google DeepMind 发布 Genie 3 引发关注,没过两周昆仑万维就推出开源交互世界模型 Matrix - Game 2.0,参数量 1.8B,单卡可跑,能实现实时长序列、交互式生成,经测试潜力大。
GPT-5通关《宝可梦水晶》创纪录!9517步击败赤爷,效率碾压o3三倍!
GPT-5通关《宝可梦水晶》创纪录,仅9517步击败赤爷,步数为o3的三分之一。它在主线任务效率也远超o3,如收集徽章、对战四天王等。其优势在于幻觉少、空间推理和目标规划能力强。
百文心快码正式发布AI IDE,首创设计稿一键转代码、支持MCP
6月23日,百度副总裁陈洋发布文心快码独立AI原生开发环境工具Comate AI IDE,是行业首个多模态、多智能体协同的AI IDE,首创设计稿一键转代码,亮点多、功能强,适配开发场景。