实测案例」共找到 737 篇相关文章

推荐文章8

破除AI Agent自主操控风险:万字解读LangGraph“人工干预”机制 ,附零基础实战

随着LLM驱动的Agent从学术走向应用,确保其行为的可靠性、安全性与可控性成关键挑战。文章以LangGraph为例,介绍其人工干预机制的核心原理、四大经典模式及案例实践,助开发者构建可靠、安全的智能代理。

腾讯技术工程
开源动态8

推理快30%,性能超过千亿参数模型,15B模型Apriel-1.6重新定义端侧推理

ServiceNow人工智能团队发布的Apriel-1.6-15b-Thinker,以150亿参数体量,多模态推理能力强,推理Token消耗降超30%。它在AI分析指数成绩佳,优化计算成本,还介绍了训练策略与多维度性能实测情况。

AIGC开放社区
产品应用7

这种眼镜我建议外卖快递小哥人手一个

亚马逊为快递小哥配备智能眼镜“Amelia”,早期版本正实测。它基于先进技术,能扫描包裹、导航等,明年中期量产。亚马逊还或推消费级眼镜“Jayhawk”,与Meta竞争。今年AI眼镜赛道热闹,国内外大厂纷纷入局。

量子位
算法论文8

告别「解码器饥饿」!中国科学院NeurIPS推SpaceServe,高并发克星

中国科学院计算技术研究所入选NeurIPS 2025的论文提出SpaceServe架构,将LLM推理P/D分离扩展至多模态场景,通过EPD三阶解耦与「空分复用」,解决MLLM推理行头阻塞难题,在Qwen2 - VL系列模型实测中表现出色。

新智元
产品应用7

当Sora2遇上国产 Vidu Q2,国产参考生真的更香了!一手亲测

国庆假期Sora 2吸睛,其客串功能将它拉到“AI版抖音”高度。但Vidu去年9月就提出【参考生】视频功能,Vidu Q2已是第5个迭代版本。文章对Vidu Q2参考生视频和Sora 2从一致性、物理规律遵循、运镜等维度进行PK。

量子位
开源动态8

阿里开源DeepResearch模型,超强“AI研究员”,开启自主智能体新纪元

阿里巴巴通义实验室开源Tongyi DeepResearch模型,是全球首个性能能与OpenAI DeepResearch较量且全开源的Web Agent。它采用先进架构,有两套推理范式,训练方法论有创新,实测表现佳,应用场景广,用Apache - 2.0许可证。

AIGC开放社区
8

OpenAI 内部是怎么使用 Codex 的.pdf

文章基于对 OpenAI 工程师的采访和内部使用数据,汇总了 Codex 在 OpenAI 内部的使用案例和最佳实践。展示其在代码理解、重构迁移等七大场景的应用,还给出使用的最佳实践,认为未来潜力大。

AGI Hunt
推荐文章7

破局大模型推理困局!华为张君详解昇腾“融合算力”的优化秘籍

华为高级开发工程师张君在AICon大会演讲,围绕大模型推理优化,从模型、框架、算子层展开,结合案例阐述技术方案。分析大模型推理现状挑战,介绍加速技术,分享昇腾硬件算子优化实践及通算融合算子优化方法。

InfoQ
新闻资讯7

AI全国榜单爆冷,全网吃瓜大狂欢!这家黑马竟靠DeepSeek杀进全国TOP 2

QuestMobile报告显示,夸克月人均使用次数居AI搜索第一,微博智搜凭DeepSeek排第二,腾讯「新闻妹」第三。实测发现,夸克产品力强,微博智搜让信息获取高效,新闻妹有划词提问等功能,AI搜索正重塑格局。

新智元
新闻资讯7

GPT-5基准测试泄露,被曝两天后发布?打Minecraft震撼开挂网友直呼封神

GPT - 5消息不断,泄露的基准测试及Minecraft实测惊艳网友。有爆料称7月31日发布,也有消息指8月。它或统一o与GPT系列,编码能力强,能处理复杂编程任务,不过也引发对其影响的担忧。

新智元