物理场景测试」共找到 3803 篇相关文章

产品应用7

Proactor AI:首个自主行动的AI 智能体,无需唤醒,就能主动识别对面是个骗子

Proactor AI v1.0发布,号称是世界首个「自主行动」的AI队友。它能感知、思考并自主行动,如识别骗局。还提供主动式AI服务,应用场景广泛,用户反响热烈,带来人机交互范式转变。

AGI Hunt
推荐文章7

一文看懂华为昇腾芯片

文章介绍华为昇腾芯片,它是面向高性能AI计算的NPU芯片,有昇腾310、910、610等系列。还提及芯片演进、参数、价格、出货量等情况,以及基于芯片的硬件体系,覆盖多场景满足不同需求。

芯师爷
新闻资讯7

Fable第一,谁第二?Anthropic钦点8款模型名单曝光

Anthropic官宣Claude Fable 5全球上线,公布安全测试结果,8款模型包括中国的Kimi K2.7。北美公司也用行动认可中国模型,Kimi在多方面表现出色,其商业模式类似Anthropic,未来潜力大。

新智元
产品应用7

codex降智大bug找到了,一句话让它把智商找回来!

近日Codex被降智,网友监测其智商曲线下降。L站大佬发现大bug及解法,在全局agents.md加特定语句,可让它大幅恢复智商。测试显示,加语句后正确率提升,降智概率降低。

探索AGI
开源动态8

RF-DETR-首个突破60 AP的实时检测器(附实战教程)

RF-DETR在COCO数据集上,实时检测精度首破60 mAP,兼顾实时性与高精度。它通过NAS找到Transformer实时运行的‘最优解’,迭代快,适用于多场景,还给出完整实战教程。

机器学习AI算法工程
新闻资讯8

ChatGPT「群聊」功能正式开启内测

OpenAI正式在部分地区试点ChatGPT群聊,覆盖移动端和网页端。该功能可用于生活娱乐、工作学习等场景,由GPT - 5.1 Auto模型驱动,操作简单,还考虑了隐私与控制。

AI寒武纪
推荐文章7

RL 是新的 Fine-Tuning

今年 9 月,Thinking Machines 研究使 LoRA 重获重视。OpenPipe 创始人 Kyle Corbitt 访谈指出,多数场景微调 ROI 低,RL 将融入 agent 生命周期成主流,但 RL 落地难在环境搭建,World Model 或为关键。

海外独角兽
产品应用7

拍个照就能测秃头等级?蚂蚁这AI医疗App我体验了一下

作者体验蚂蚁AQ这款AI医疗App,发现它以看病需求完成场景闭环,融合医保、支付等功能。该App问诊、识图功能有亮点,但也存在诊断笼统、部分影像无法识别等问题。

量子位
开源动态8

外卖公司也能搞AI?

昨天凌晨美团悄悄开源560B参数的MoE大模型LongCat-Flash-Chat,引发国外网友疑惑。该模型推理速度超100 tokens/秒,基准测试表现出色,多项设计解决实际问题,贴合美团业务需求。

AGI Hunt
开源动态8

DeepSeek V3.1 Base突袭上线!击败Claude 4编程爆表,全网在蹲R2和V4

昨晚,DeepSeek官方悄然上线全新V3.1版本,上下文长度拓展到128k,参数685B,支持多种精度格式。其编程能力突出,在Aider测试中霸榜,性能超越Claude Opus 4,还有成本低等优势。

新智元