「文心大模型5.0」共找到 8909 篇相关文章
眼馋苹果刚发布的液态玻璃效果?藏师傅教你提示词一键实现
苹果 WWDC2025 发布的液态玻璃效果引关注,虽卡片中心可读性差,但预计会被广泛使用。藏师傅探索出将其融入网页生成的提示词,介绍了在不同模型上的效果及提示词内容和使用注意事项。
Gemini 3「开眼」像素级操控!谷歌回应DeepSeek-OCR2
Google DeepMind为Gemini 3 Flash推出Agentic Vision,让模型主动编代码操控图像,性能提升5% - 10%。该能力已上线,谷歌还计划扩展功能。这或许是受DeepSeek-OCR2刺激,两者技术路线不同。
1/8成本比肩Claude 3.7,Mistral Medium 3来了
“欧洲OpenAI”Mistral AI发布多模态新模型Mistral Medium 3,主打编程和多模态理解,成本仅Claude 3.7的1/8,性能达其90%,API已上线,还推出企业聊天机器人服务,引发网友不同看法。
字节开源"超级AI员工"框架,发布即登GitHub Trending第一!
字节跳动火山引擎开源 DeerFlow 框架,2.0 版本发布即登 GitHub Trending 第一。它是超级智能体 harness,能让 AI 真正执行任务。有 Sub - Agents、Skills 等核心能力,对模型无强绑定,还介绍了使用方法。
图灵巨擘RL教父齐聚,机器人秀拳脚嗨翻全场!「悟界」首发引爆物理AGI
智源大会开幕,四位图灵奖得主等出席。会上,Bengio提出‘科学家AI’应对安全风险;Sutton称AI迈入‘体验时代’;Hausman讲构建物理智能。智源还发布‘悟界’系列大模型,含Emu3、Brainμ等,迈向物理AGI。
谁是最强“打工AI”?OpenAI亲自测试,结果第一不是自己
OpenAI发布新研究,提出GDPval基准衡量AI模型在有经济价值任务上的表现。Claude Opus 4.1表现最佳,GPT - 5次之。OpenAI开源优质子集并提供自动评分服务,还指出了GDPval的局限。
AI跌价900倍,连一瓶矿泉水都比它贵!
过去一年,AI模型价格暴跌,不同层级降价差异大,如GPT - 3.5费用降280倍。但人们使用更频繁,引发AI版杰文斯悖论。同时人工变贵,且AI降价使权力更集中,引发价值重组。
Gemini准确率从21%飙到97%!谷歌只用了这一招:复制粘贴
Google Research研究发现,将输入问题复制粘贴一遍,能让大模型在非推理任务上准确率惊人提升,如Gemini 2.0 Flash - Lite从21.33%升至97.33%,且几乎不影响生成速度,但不适用于推理场景。
商汤林达华万字长文回答AGI:4层破壁,3大挑战
在WAIC 2025上,商汤发布国内首个实现“图文交错思维”的商业级大模型日日新6.5。商汤科技联合创始人林达华发文,剖析多模态通用智能实践,解答AI领域关键问题,提供通往AGI的参考。
字节开源DreamO,一个框架包揽多种图像定制需求
近期图像定制研究展示大规模生成模型潜力,但多数方法通用性有限。字节提出DreamO框架,支持多种图像定制任务,有特征路由约束机制,能解决特征冲突,还介绍其技术原理与各任务效果。