「人类在环」共找到 8726 篇相关文章
Sam Altman提醒创业者:ChatGPT将来要做的,大家就绕开吧
在Y Combinator举办的AI Startup School活动采访中,OpenAI CEO Sam Altman复盘创业历程,分享对AI未来的看法,包括从问答工具到智能体的进化、对软件和机器人行业的影响,还为创业者给出战术建议。
高考第一天,用豆包修图3.0花式「整活」送祝福,已原地笑翻!
豆包的一句话P图功能进化,其图像编辑模型SeedEdit 3.0全量上线,AI修图进入3.0时代。用自然语言就能精准编辑图片,在文字编辑、局部修改等方面表现出色,还突破以往模型瓶颈,成设计师利器。
谷歌开源移动端AI自动化测试神器
本文介绍谷歌最新开源的移动端AI自动化测试工具ARTEMIS,它可将自然语言指令转化为Android自动化操作,支持跨App测试、多模态定位,在AndroidWorld基准评测中取得99%+任务完成率,提供多场景使用方式,可一键快速上手。
刚刚,Anthropic发布Sonnet 5,性能接近Opus 4.8,但不一定更便宜
Anthropic发布Claude Sonnet 5,称其为最具Agent属性的Sonnet模型。它在推理等方面性能提升,接近Opus 4.8且价格低。安全评估有改善,但网络安全逊于Opus 4.8。已正式可用,有优惠首发价。
阿里发布新一代千问旗舰模型Qwen3.7-Max,登顶最佳国产模型
5月20日,阿里发布新一代千问旗舰模型Qwen3.7 - Max。近三月千问迭代三次,Qwen3.7 - Max在多测评中表现优异,位列国产模型第一。它强化编程等能力,阿里还通过MaaS等连接各环节,布局AI基础设施。
又上Trending,这个项目赋予AI灵性,可以和你一起玩游戏看电视!
项目 AIRI 可让用户轻松拥有数字生命。与其他项目不同,它支持多种 Web 技术,能在现代浏览器和设备运行,还能玩游戏、看视频。目前已完成部分基础功能,支持众多 LLM API 服务,还衍生出多个子项目。
GLM-5正式发布,744B参数,对标Claude
GLM-5正式发布,对标Claude,参数从355B扩至744B,预训练数据增加。采用GlmMoeDsa架构,部署成本降低。数据表现佳,在多测试中成绩亮眼,还能直输Office文档,部署支持多框架和国产芯片,早期反馈积极。
加速突围!9款信号链芯片背后的“芯”趋势
在高端ADC/DAC领域曾被国际巨头长期垄断。2025年‘芯师爷 - 硬核芯年度评选活动’展示多款信号链芯片。国产芯片发展有高端突破、汽车电子爆发、全产业链延伸三条路径,但也面临参数提升、高端场景拓展及海外竞争挑战。
真实评估!北理发布全球首个「全场景教育」基准,支持4000+情境
北京理工大学高扬老师团队推出EduBench,是全球首个「全场景教育」基准,涵盖9大教育场景、12个评估维度、超4000个情境。团队将数据、模型等全面开源,评估发现大模型在特殊教育场景有不足,还提出多源知识蒸馏等方法。
让GPT-4.1「头皮发麻的考试」!OpenAI给大模型上强度,AI能赢吗?
OpenAI 公布 MRCR 评测标准数据集,其针对 AI 模型上下文能力进行「奥运会」级别测评。MRCR 提升了测试难度,能揭示 AI 能力边界,推动模型发展,帮助更合理应用技术。GPT4.1 在一些测试中表现出色,未来 AI 能力上限充满可能。