「AI研发自动化」共找到 10109 篇相关文章
“大模型第一股”打响上市前哨战!智谱GLM-4.7 刷新开源编程SOTA,修复代码、终端操作表现超Claude 4.5
冲刺大模型第一股的智谱推出开源大模型GLM - 4.7,主打编程与代理式任务提升。它在多项基准测试中表现出色,UI质量飞跃,还采用新推理机制。智谱上市在即,但亏损扩张快,研发投入大。
Claude Opus 4.7 发布!留给人类的时间,不多了
Anthropic 发布 Claude Opus 4.7,核心升级是让 AI 跑长且复杂任务,还能自我验证结果。它视觉能力超强,编程能力提升,新增 /ultrareview 功能,API 多了调节档,不过 token 数量或增加,成本可能上浮。
Jev火爆全网后,Open Jev们扎堆开源了!精选8个项目
TypeSafe AI发布的Jev模型凭借新的结构化决策接口迅速爆火,引发社区复刻潮。本文精选整理了8个不同技术路线的开源OpenJev项目,逐一介绍各项目的思路、性能、优缺点与适用场景。
Claude Code 豪气收购一家0收入前端公司:押注一位高中辍学创始人
当地时间12月2日,Anthropic宣布收购热门开发者工具初创公司Bun。此次收购标志其向开发者工具领域迈进,因Bun能解决智能体分发和运行效率问题,且被众多AI编程工具使用。
倒反天罡:ChatGPT教人说话?36万视频+77万播客已证实!
最新研究警告,ChatGPT正改变英语表达方式,植入自身偏好。研究人员分析超36万视频和77万播客,发现GPT词汇使用率显著攀升。但研究有局限,且AI沟通还引发信任危机等问题。
突发:OpenAI收购计划泡汤!Windsurf创始团队转投Google怀抱
据The Verge报道,OpenAI 30亿美元收购AI编程初创公司Windsurf交易告吹,其CEO等核心团队转投Google DeepMind。Google获部分技术非独占授权,交易呈现“反向收购”模式,凸显人才流动性重要。
Correlations:氛围测试你的向量模型
Jina AI分享内部调试可视化向量小工具Correlations,它能生成交互式热图展示内容间余弦相似度,提供多种交互方式。工具已在GitHub开源,适用于内容去重、验证引文等场景。
紧跟诺奖得主,斯坦福经济学泰斗火速入职Anthropic!
IPO敲钟前夜,斯坦福经济学教授Charles I. Jones(Chad Jones)将加入Anthropic研究所。该公司正组建‘政经智囊团’,因民调显示64%美国人恐慌AI夺饭碗,需Chad Jones用经济学模型应对。
Claude Code 修了几个小 bug,却揭开了 Agent 落地的大麻烦
Anthropic给Claude Code发的更新,看似是修小bug,实则指向AI编程产品正从“模型会不会写代码”转向“Agent能否稳定完成任务”,暴露了工具状态、权限边界等执行问题。
北大开源统一世界模型框架:多类合成推理任务一套搞定
世界模型研究中,不同任务存在接口不统一等问题。北大DCAI课题组联合多方推出OpenWorldLib推理框架,整合多模态能力,构建标准化接口体系,在多任务上评估效果良好,降低研发门槛。