「端侧智能体模型」共找到 9644 篇相关文章
苹果新作:内化视觉思考,推理提速 5 倍
Apple研究团队提出Internalized Visual Thinking(IVT),一种将预测性世界建模能力内化到模型表征中的后训练框架。它在训练时预测未来,推理时直接回答,相比Visual CoT推理提速超5倍。
刚刚,谷歌Gemini 3.8登场!姚顺宇:RSI巨大飞跃
深夜谷歌推出Gemini 3.8,六周内第三款Flash系列模型。含通用的Gemini 3.8 Flash和网络安全专用的Gemini 3.8 Flash Cyber,提升推理、代码能力,在多场景表现出色。已面向不同群体开放。
牛B, 我真的起飞啦,6.4k Star Bright Data CLI~~~~
约6.4k Star的Bright Data CLI想解决AI Agent访问网页难题,把网页变成易被模型读懂的材料。它将网页访问能力拆成终端可组合动作,还关注工程化细节,让Agent上网有章可循。
Fable 5.1 官方提示词指南
Anthropic 发布 Fable 5.1 后,同步发布《Prompting Claude Fable 5.1》提示词指南,列出 15 个 5.1 跟 Fable 5 在行为上的差异,并附修正提示词。还介绍了 Fable 5 提示词变化,以及 Fable 5.1 的新特性和应对建议。
撞名Anthropic的“外挂”刷屏:让“DeepSeek V4‑Pro碾压 Fable 5”但无人能复现,Token开销反而翻倍
J - Space Cognition Suite社区项目在X上传播,称不修改DeepSeek V4 - Pro模型权重,用推理时Harness能提升其在多项Agent Benchmark表现,超Fable 5,但未第三方复现,且Token开销可能翻倍。
Agent 基建不是设计出来的,是被 Kimi K3 和一堆应用公司卷出来的
文章以 Kimi K3 模型及相关 agent 产品为例,讲述 TiDB 作为基建服务商,满足 AI 团队需求形成 Agent Stack。还指出 Agent 时代基建难题、数据库使用变化,以及创业团队做 Agent 业务的三个判断。
GPT-5.6 Sol暴涨3倍,OpenAI最强视觉AI登顶!
第三方评测机构Roboflow测试显示,GPT-5.6 Sol在目标检测、计数等视觉任务上表现出色,尤其在文档版面识别和密集场景处理上进步明显,但认字能力有退步,且大尺寸图片检测框易飘移。
一个极度实用的深度思考Prompt,帮你挖出最本质的答案。
作者分享推特上一个让大模型深度思考的Prompt,调研后引入‘钢人论证’概念,指出其能避免AI谄媚。作者还写双向钢人Prompt,介绍其作用,并以公司司庆日选择为例展示效果。
Claude 上线隐形水印
从上周起,Anthropic 在 Claude 模型所有文本输出中嵌入隐形水印。该水印在文本生成时织入文字,复制粘贴也保留,编辑修改可能仍在。标记机制分文本水印和文件元数据两层,全球生效。
Claude有「编制」了!Anthropic发的
6月23日,Anthropic发布Claude Tag,它是常驻Slack频道的AI团队成员,有自己的身份、账号和审计轨迹。其核心是权限架构,采用智能体身份,按用量计费,已对企业版和团队版客户开放beta。