「AI测试」共找到 10719 篇相关文章
从15个研发配1个设计,倒挂成1个研发配2个设计!OpenAI设计主管:现在是有史以来 成为设计师的最佳时机
在科技行业,产品设计师与用户研究员对职业前景焦虑、满意度低,而OpenAI产品设计负责人Ian Silber认为当下是成设计师最佳时机。他与Lenny探讨AI时代设计变革,分享应对策略、人类设计师价值等观点。
哈佛《Science》研究:大模型已碾压人类医生!
哈佛医学院等团队让OpenAI o1系列大模型与数百位医生在多项测试中较量,大模型在各项诊断和管理推理任务上全面超越人类专家,不过当下模型处理非文本信号有局限。
“守成者”库克卸任CEO:除了离开,他再没有什么能留给苹果了
4月20日晚苹果宣布,库克2026年9月1日起转任董事会执行主席,硬件工程高级副总裁John Ternus接任CEO。库克掌舵15年将苹果带到新高度,但苹果在AI浪潮中表现保守,换帅或让苹果重回科技中心。
奥特曼遭遇死亡威胁:凌晨家中被投燃烧瓶
当地时间凌晨3:45,OpenAI CEO奥特曼家中遭20岁男子投掷燃烧瓶,嫌疑人已被捕。奥特曼发文报平安,还分享家人照片,同时写下对AI行业现状思考及与马斯克等冲突的反思。
林俊旸从阿里离开后首度发声:推理模型的时代快结束了
前通义千问Qwen负责人林俊旸离职后发长文,指出AI正从「推理思考」转向「智能体思考」,分析推理模型发展,谈混合思考模式失败,还提及智能体思考挑战及相关企业、学术界进展。
深圳SEO&GEO大会:搜索没死,只是竞争规则变了!
深圳SEO&GEO大会探讨搜索新形势,多位嘉宾分享见解。如Zac老师认为AI增长不代表搜索失价值,SEO应随搜索逻辑升级;Paul老师提出大品牌应将SEO目标转向争答案席位等。
OpenClaw中国行北京站落幕,3万人围观养虾,本周12城活动继续
2026年3月21日,OpenClaw中国行首站北京站举办,近200名开发者参与,3万多人次在线围观。活动承诺30分钟跑通AI应用,多位嘉宾分享使用经验与见解,还设置开放麦环节。本周末将登陆12城继续活动。
从多模态大模型中「拆」出音频向量模型
Google 发布原生多模态向量模型 Gemini Embedding 2,推动 Omni Embedding 发展。Jina AI 团队分享从多模态大模型中「拆」出音频向量模型的经验,介绍架构、训练数据,对比四种做法,还提及评测、应用场景及结论。
我国Chiplet产业的真实水位与全产业链突围
国内Chiplet市场快速增长,但与国际仍有差距。国家和地方给予政策与资金支持,多个联盟推动标准化。企业在设计、封测、EDA等领域积极布局,但面临核心技术、设计测试、产业链协作等挑战。
Qwen“半成品”推理模型刷下AIME满分,俘获大批国外开发者!实测碾压GPT-5 Thinking、还能写侦探小说
阿里发布 Qwen3-Max-Thinking 早期预览版,虽是‘半成品’,在数学推理竞赛中达 100% 正确率。Qwen3-Max-Preview 多项测试领先,速度超 ChatGPT,还成 AnyCoder 默认选项,但未开源。实测表现有优有劣。