「港中深」共找到 2754 篇相关文章
全球顶尖AI做物理,被人类按地摩擦?不懂推理大翻车,本科生碾压
港大等机构用3000道物理题测试顶尖大模型,如GPT - 4o、Claude 3.7 Sonnet等,结果模型准确率远低于人类专家。研究推出PHYX基准测试,揭示模型依赖知识、公式和模式匹配,缺乏真正物理理解。
刚刚,奥特曼炮轰达里奥「反人类」!绝密模型同日曝光
OpenAI员工「手滑」暴露模型代号gpt - nathree,引发GPT - 6 Astra将至的猜测。Anthropic也有新模型曝光。同时,奥特曼在播客中认错、怒批行业营销话术,还分享了OpenAI的创业历程。
Anthropic 在 Claude 内部发现"全局工作空间",可以直接读取模型没说出口的想法
Anthropic发布研究,在Claude内部发现J - space(雅可比空间),即“全局工作空间”,它在训练中自发形成。用雅可比透镜技术可读取其内容,还验证了其功能属性,可用于对齐审计等。
哈佛《Science》研究:大模型已碾压人类医生!
哈佛医学院等团队让OpenAI o1系列大模型与数百位医生在多项测试中较量,大模型在各项诊断和管理推理任务上全面超越人类专家,不过当下模型处理非文本信号有局限。
“守成者”库克卸任CEO:除了离开,他再没有什么能留给苹果了
4月20日晚苹果宣布,库克2026年9月1日起转任董事会执行主席,硬件工程高级副总裁John Ternus接任CEO。库克掌舵15年将苹果带到新高度,但苹果在AI浪潮中表现保守,换帅或让苹果重回科技中心。
刚刚,智谱正式成“全球大模型第一股”,开盘涨超3%!10位董事7个清华背景,专家:国内IPO抢收“确定性”,OpenAI们豪赌“无限性”
今日,智谱在港交所挂牌上市,成“全球大模型第一股”。其有技术、产品、商业化优势,但未盈利,研发投入高。专家认为其上市早,国内厂商上市为求确定,而OpenAI等是扩展无限。
2025年最戳心的纪录片:程序员的变与不变,太真实了
文章围绕《十字路口》纪录片,讲述开发者在 AI 时代的变与不变。AI 使开发权下沉,传统开发者角色被重新定义。纪录片记录开发者蜕变,展现其在行业变革中的选择,揭示技术革命中“人的价值重构”。
苹果分享 iOS 26 即将推出的 AI 基础模型的细节
苹果在技术报告中公布 iOS 26 新 AI 基础模型细节。该模型有 3B 参数和更大版本,前者在设备运行,后者用于私有云平台。介绍了架构、评估结果,还强调实现可信赖 AI 的方法。
60%情况下,主流大模型没理解风险只是装懂!别被模型的“安全答案”骗了
研究发现超60%案例中主流推理模型生成合规答案却未真正理解风险,存在系统性漏洞。淘天集团团队引入“表面安全对齐”术语,推出Benchmark研究该现象,还介绍了数据集生成流程及评测指标。
R1/Qwen训练新范式:无需继续训练,直接“算”出权重,提效500%
DeepSeek - R1爆火让RLVR成大模型后训练焦点,但训练代价高昂。学者发现RLVR中LLM权重和输出概率呈线性变化,提出“权重外推”等方法,实现最高6.1倍训练加速,RL - Extra在多榜单展现高效率。