中文字生成」共找到 4604 篇相关文章

新闻资讯7

OpenAI公开4+10条保命指南,专防AI自动化攻击

OpenAI联合创始人兼总裁Greg Brockman在Blog警告,前沿AI Agent能自主找漏洞并发动网络攻击,AI降低攻击门槛,防御端却未跟上。他分享OpenAI四项安全措施及防御者十项举措,呼吁行业共建安全生态。

量子位
推荐文章7

自构建智能体:一项 LangChain4j 实验

作者将LangChain4j文档交代码助手,让其参照构建智能体,设计多智能体系统编写、测试和调试代码。实验展示了LangChain4j优势,还对比监督者和工作流两种智能体实现模式,揭示速度与自主性权衡关系。

InfoQ
开源动态8

机器人需要一个「思考系统」:τ0-VLA让具身智能迈向长程任务时代

2026 WAIC落幕,具身智能成焦点。当前VLA模型在长程任务有局限,上海创智学院和智元机器人联合发布τ(0)-VLA,提出分层架构和新推理机制,用大量真机数据训练,在长程任务表现出色。

机器之心
算法论文8

夜间感知新突破!北航等提出红外主导的高效目标检测方案 | ECCV'26

在复杂视觉场景,传统RGB - IR多模态检测方法在低照度等场景下因RGB退化影响检测效果。北航等团队提出的InfraNet,以红外为主,用质量感知机制控制RGB引导,在多数据集取得强竞争力结果。

新智元
新闻资讯8

刚刚,Opus 5来了:性能不输 Fable 5、价格砍半

Anthropic 发布新一代模型 Claude Opus 5,其智能接近 Claude Fable 5 但价格减半。它在编程、知识工作等评测表现出色,科研能力进步大,自主性与严谨性更强,安全对齐度高,防护兼顾安全与可用。

机器之心
开源动态8

让Skill“有图可依”:openJiuwen首发多模态Skill范式Skill-Omni

openJiuwen社区发布业界最早工程化落地的多模态Skill范式Skill-Omni,让Agent经验从‘读得懂’升级为‘看得见’。它能将网页和视频视觉知识沉淀为多模态Skill,还介绍了生成及读取方式和适用任务。

量子位
开源动态8

单次训练横扫9个基准,遥感检测最大数据集与基础模型框架问世

北京航空航天大学团队发布面向通用遥感目标检测的大规模数据集与基础模型框架 LEVIRDet,构建了 LEVIRDet - 159 数据集,提出 LEVIRDetNet 模型。前者为训练泛化能力强的模型提供新数据基础,后者在多基准测试表现出色。

机器之心
算法论文8

机器人看视频学操作!伯克利首次打通互联网视频到灵巧手真机部署链路

UC Berkeley团队提出端到端流程,跑通从网络视频生成真实灵巧手实机执行轨迹链路。解决了单目RGB视频手-物交互重建、带噪声参考轨迹动作重定向及遥操作规模化难题。还给出数据筛选要点。

新智元
新闻资讯8

这家 AI Lab 宣布所有模型无限期免费后,我顺手做了个图片版番茄钟

全球排名前十的 AI Lab,Agnes 宣布旗下核心全模态模型 API 无限期免费开放,包括文本、图片、视频。还新增百万 Token 上下文和 4K 图片生成功能。作者用其做了图片版番茄钟,官方也公开开发进度。

AGI Hunt
新闻资讯7

Anthropic CEO承认了!成立公司,因为看不惯奥特曼说谎

Anthropic CEO Dario Amodei在采访自曝,成立公司不是为拯救人类,而是看不惯奥特曼说谎。这撕下了Anthropic恪守伦理的滤镜,揭示出其与OpenAI的纷争是团队内讧,如今已演变成万亿美元商战。

新智元