「Claude模型」共找到 8669 篇相关文章
GPT-5 之后,我们离 AGI 更近了,还是更远了?
2025年8月8日OpenAI发布GPT-5,架构有革新,在基准测试成绩优异,但跑分现场PPT出错、被Grok 4击败。它在编程表现出色、价格有竞争力,写作能力有争议,模型幻觉和提示注入攻击问题待解。
“掩码即武器”,四款扩散LLM全部破防 ? 上交&上海AI Lab发现dllm致命安全缺陷
上海交通大学、上海人工智能实验室等团队研究指出,扩散语言模型(dLLMs)有根本性架构安全缺陷。他们提出DIJA攻击框架,能让多个dLLMs大概率生成有害内容,还呼吁从多方面加强dLLM安全。
77岁Hinton首度访华,周伯文高能交锋!17分钟尖峰对话震撼全场
7月26日,77岁的AI教父Hinton首度访华,与周伯文教授进行17分钟尖峰对话。Hinton称多模态大模型已有「意识」,建议分技术训练「聪明」与「善良」AI,两人还探讨AI发展路径并寄语青年科研者。
OpenAI被曝IMO金牌「造假」,陶哲轩怒揭内幕!
OpenAI高调宣称摘下IMO数学金牌,却被组委会内部人士爆料未与官方合作、无视规则提前官宣。菲尔兹奖得主陶哲轩暗指其成绩存疑,网友也不满其炒作。UCLA教授认为大模型短期难取代数学家。
AI-Native 的 Infra 演化路线:L0 到 L5
文章来自 Agent Infra 创业者 Hang Huang,以其产品开发实践经验,分享 Agent Infra 机会。指出 AI 编程生产力跃迁,从写代码到掌控软件全生命周期是趋势,还提出 L0 - L5 模型描述 AI-Native Infra 演化路径。
千亿多肽市场迎来Scaling时刻,清华校友创业用AI重写发现规则 | 对话利太智药贾寅君
本文对话利太智药贾寅君,他从临床医学转向AI药物发现,创业聚焦多肽。他认为多肽泛用性强,能覆盖更多靶点。其团队构建合成数据,开发模型,如MEET、PepMirror,探索将技术落地成药。
笑死,网友支招,破Agent长对话"变蠢"
文章指出用AI编程时,上下文一长模型就易“变蠢”,如违反约束、反复改文件等。分析原因是难从海量历史找重点,给出应对策略,还介绍Claude Code、Cursor、Codex等工具操作方法。
The Batch:924|GPT-5.4:性能更高,价格也更高
OpenAI更新旗舰模型GPT-5.4,有Thinking和Pro两个版本,扩展工具使用能力,多基准测试达当前先进水平,但定价高。虽在部分任务表现超Claude,挑战Gemini地位,不过成本也更高。
谷歌研究院探索多智能体协调的扩展原则
谷歌研究院对180种智能体配置对照评估,得出‘AI智能体系统首批定量扩展原则’。发现多智能体协同效果因任务而异,还指出工具使用瓶颈等问题,且开发预测模型辅助架构选择。
AI for Health:从「实验室Demo」到「国民级健康伙伴」的范式跃迁 | GAIR Live 024期预告
医疗大模型正从“聊天工具”进化为“生命基础设施”,但面临诸多挑战。GAIR Live 024期圆桌将汇聚学术与产业顶尖智慧,探讨构建可信、高效、人机协同的医疗新范式,剖析核心议题,分享讨论精华。