「4D生成」共找到 3704 篇相关文章
这才叫AI原生应用:Google Slides
Google Slides是Google版AI PPT,与传统AI PPT不同。它像传统PPT搭配AI聊天机器人,用Nano Banana模型可直接生成图片和文字,能像素级推理,打破传统PPT结构,还可自然语言交互修改,只是中文生成效果待提升。
【实测&解读】全球首个手机通用Agent——AutoGLM 2.0发布!我喝到了AI为我点的第一杯咖啡~
智谱更新的AutoGLM 2.0是全球首个手机通用Agent,适配苹果和安卓手机,无需交出手机使用权。它配备云手机和云电脑,由GLM - 4.5和GLM - 4.5V驱动,能完成点咖啡等多场景任务,因风险控制付款需人确认。
32个随机数字,1分钟推演地球未来15天丨谷歌DeepMind
谷歌DeepMind发布WeatherNext 2,运行速度比上一代快8倍,分辨率达小时级。其关键是新提出的FGN功能生成网络,通过输入32个随机数字生成多样天气情景,速度快且准确率高,虽有小瑕疵但实用。
智谱AI、清华开源新视觉大模型:刷新41项纪录,同级别最强
智谱AI与清华联合开源GLM - 4.5V视觉大模型,它基于GLM - 4.5 - Air开发,架构独特。在42项主流测试中创41项新纪录,多领域表现超Qwen2.5 - VL等模型,还采用新训练策略。
HBM之父:HBM的终点是HBF
韩国SK海力士宣布完成HBM4开发,它将成数据中心和AI芯片首选。HBM4有出色数据处理速度和能效,应用后AI服务性能或提升69%。HBM之父金正浩教授预测,未来HBF将取代HBM,还提出金氏定律指导行业发展。
一场对话,我们细扒了下文心大模型背后的技术
信通院大模型推理能力评估中,文心X1 Turbo获最高级“4+级”。百度AI Day上,副总裁吴甜解析文心4.5 Turbo和文心X1 Turbo,从多模态、深度思考等方面介绍技术,还展示其在多场景应用成果。
交互式世界模型来了:不止理解世界,更要改造世界
8月17日,智象未来发布交互式世界模型HiDream - O1 - World,定位为全球首款原生全模态交互式世界模型。它提供漫游和编辑两种交互方式,在WBench测试中成绩优异,但开放场景表现待验证。其采用独特生成方式,有广阔应用前景。
打破具身世界模型可执行性鸿沟 !港中深-跨维智能团队提出EVA框架,用强化学习让视频世界模型真正“动”起来
近期,利用视频生成模型为机器人构建“世界模型”成热门路线,但存在“可执行性鸿沟”。港中深 - 跨维智能团队提出 EVA 框架,用强化学习优化视频生成,实验显示其能提升视觉规划、仿真任务成功率及真实部署稳定性,还有数据合成潜力。
AI水论文封一年,署名连坐!arXiv最严新规来了,陶哲轩附议
arXiv计算机科学版块主席公布新规,上传AI水论文被查实者封禁一年,后续投稿须先同行评审。若有未核查LLM生成内容证据,署名作者连坐。陶哲轩附议,指出论文生成易、消化难,新政方向正确,但治不了学术‘争先为首’病根。
谷歌新版Gemini一夜端掉UI:单HTML文件复刻macOS,成功率100%
谷歌新版Gemini 3.0 Pro能力惊人,几行提示词就能在浏览器复刻苹果macOS,还能生成网页版Windows、Linux,功能完整且能一次生成,代码已公开。不过有网友指出这只是模拟环境。业内推测其或在未来几个月发布。