「功能测试」共找到 3143 篇相关文章
Altman 投的 Agent 终端 Warp 开源了,15小时Star 数飙到3.5万!开源是延长软件寿命的最佳方式
由 Sam Altman 支持的现代终端 Warp 正式在 GitHub 开源,OpenAI 成新代码库创始赞助商。Warp 团队认为传统开发模式遇瓶颈,开源可汇集全球创意,还在功能上开放,引发社区热议。
5Y News | 寻明生科完成数千万美元A+轮融资
近日,寻明生科宣布完成3500万美元A+轮融资,由红杉中国领投。资金将用于建设创新功能抗体设计平台AuraIDE™,打通智能体关键环节,加速创新药管线临床转化,其已实现千万美元商业收入。
高盛怕了!Claude Mythos全球首个攻破企业网络,奥本海默时刻来了
英国AI安全研究所研究显示,Anthropic发布的Claude Mythos Preview模型在网络安全评估中表现惊人,能全自动、全自主完成企业网络攻击模拟。高盛为此加强网络防御,人类网络安全或进入奥本海默时刻。
探针伸进大模型黑箱,南加州大学华人团队打造AI记忆研究的深空望远镜
南加州大学 Robin Jia 教授团队借助英伟达算力,构建基于 Llama 3 架构的全开源受控大模型 Hubble,其成果将在 ICLR 2026 亮相。研究揭示大模型记忆机制效应,还评估了‘机器遗忘’技术,有法律应用潜力。
这款 Rust 文件搜索项目,让 AI 和 neovim 飞起来!
开发时项目大文件多,找文件成本高。Github上的`fff.nvim`项目专注‘极致速度 + 智能体验’,采用Lua + Rust架构,性能好、排序智能。有多项功能特性,还能与AI助手集成,提升效率。
The Batch: 939 |在推理阶段学习长上下文
大型语言模型处理长上下文时通常准确性降低、速度变慢,研究人员提出TTT - E2E方法,通过推理时训练模型将上下文压缩到transformer权重中,还展示了其运作方式、测试结果等。
让思考更准更长!强化学习新算法FIPO来了
阿里通义实验室Qwen Pilot团队发布系列博客剖析大模型强化学习机制与局限,推出新算法FIPO。该算法引入Future - KL机制,解决‘推理长度停滞’问题,在多项测试表现优异,还介绍招聘信息。
Claude灾难级大宕机,全球开发者集体炸锅!Anthropic三连翻车被怒喷
4月6日Claude新功能Ultraplan上线就遭遇大规模宕机,开发者看到满屏‘授权失败’等。此前源码泄露,现又被指修改系统提示词报错、性能下降。虽Ultraplan有效果,但token消耗大,Anthropic太急,产品稳定性堪忧。
传统PM假设已死!Anthropic的产品经理是怎么工作的?
文章指出在AI指数级增长时代,传统产品管理假设已不适用。以Anthropic的Claude Code为例,展示模型能力大幅提升,介绍了新的产品管理工作流程、四个根本性转变及新节奏,强调判断力的重要性。
搞不懂Skills?看看Claude Code内部工程师们是怎么玩的
文章来自Anthropic的Claude Code团队工程师,介绍了Claude Code中Skills功能。阐述Skills定义、类型,给出制作技巧,如避免陈述显而易见内容、构建陷阱部分等,还提及分发、管理、组合及衡量效果的方法。