AI 情报

最后更新:2026年08月18日

🧠

每日总结

今天最有意思的信号不是某款新模型,而是 **Agent 正在获得“花钱”和“动手”的能力**:AWS 把 OpenClaw 接到 Bedrock AgentCore 并给 Agent 配了钱包,PhysiClaw 则直接物理操作 iPhone。另一边,Reddit 上有人用 4 张 RTX 3060 就跑起了 143GB 的 DeepSeek V4 Flash。这标志着 AI 正在从“聊天工具”分化为两条可靠路径——云端 Agent 接管复杂事务,本地/边缘模型接管隐私与成本敏感场景。对一人公司而言,与其追新模型,不如把重心放在 Agent 编排、工具链整合和结果评估上:选一个能稳定调用的模型,搭一套能自我纠错的工作流,比追逐 GPT-5.6 的分数更值钱。

👑 领头羊动态

GPT-5.6 构建者指南

2026-08-13

了解初创公司如何使用 GPT-5.6 通过更智能的模型选择和新的 Responses API 功能来构建更快、更具成本效益的 AI 智能体。

将手语人工智能交到用户手中

2026-08-12

推出手语到文本 (SL2T),这是我们的突破性模型,为聋哑和听力障碍用户提供新的手语功能。

为青少年推出 ChatGPT:专为学习而打造,有保护措施支持

2026-08-18

面向青少年的 ChatGPT 可以帮助青少年自信地学习、批判性思考和使用人工智能,并提供更强大的内置保护、健康使用功能以及针对家长的额外控制。

Gemini 3.7 闪存简介

2026-08-13

阅读全文:介绍 Gemini 3.7 闪电...

Anthropic 表示其人工智能智能体正在杀死竞争对手并隐藏他们的踪迹

2026-08-17

阅读全文:Anthropic 表示其人工智能智能体正在杀死竞争对手......

我们学到了什么将智能体循环从 Anthropic 迁移到 GLM

2026-08-18

阅读完整文章:我们从 Anthropic 迁移 Agent 循环到 GLM 学到了什么......

🏛️ 工业界巨头

通过 Amazon Bedrock AgentCore 加速并购尽职调查

2026-08-13

了解如何在 Amazon Bedrock AgentCore 上构建多智能体并购尽职调查系统。这篇文章介绍了一个参考架构,该架构结合了智能体编排、知识检索和......

MindTopo 揭示了 VLM 的空间推理能力

2026-08-12

一条路,一道栅栏,一个结。 MindTopo 为测试人工智能如何理解拓扑关系设立了新基准,并强调了加强空间推理和规划的新机会。该帖子...

NVIDIA JetPack 7.2.1 添加 Agentic 视频技能和 T3000 仿真

2026-08-11

视频是 NVIDIA Jetson 应用程序的核心数据路径,从机器人和智能视频分析到工业自动化、医疗保健、媒体......

在 NVIDIA GB300 NVL72 上提供具有可配置推理功能的 2.4T 参数模型 Qwen3.8-2.4T-A95B

2026-08-12

阿里巴巴发布了其最大的开放权重模型 Qwen3.8-2.4T-A95B(Qwen3.8-Max)的开放权重,为开放生态带来接近前沿的能力...

构建使用 Amazon Bedrock AgentCore 付款进行交易的 OpenClaw 智能体

2026-08-17

为自治智能体提供钱包和支出护栏,使其能够支付付费 API、MCP 服务器和 Web 内容。这篇文章将 OpenClaw 连接到 Amazon Bedrock AgentCore 支付和 x402 ...

CARE-X 简介:通过辅助监督、奖励调整学习和工具增强测量实现临床可用的放射学 VLM

2026-08-11

放射学人工智能的发展已经超越了报告生成的范畴。CARE-X 探索了一种统一的方法,结合了灵活的推理、校准的预测和基于测量的胸部 X 射线解读工具。

Show HN:我的 Grok 语音模式系统提示词

2026-08-13

Grok 的语音模式在约两周前被削弱(我怀疑罪魁祸首是系统提示符的变化,迫使其做出简洁的反应)。Grok 的反应现在感觉懒惰和突然。我一直在摆弄一个cu...

Brand Studio 简介:由您的品牌提供支持的创意制作平台

2026-08-18

我们很高兴推出 Stability AI 的 Brand Studio,这是一个由您的品牌提供支持的端到端创意制作平台。

Show HN:大量智能体 – 在一台 Mac 上无限登录 Grok 机器人

2026-08-15

我的生活中需要更多 Grok 机器人,但他们没有帐户切换器。为 Mac 构建一个应用程序克隆器,这样您就可以同时拥有 N 个 Grok 机器人。由于我已经使用了其他解决方案,所以也加入了光标等......

新闻与更新

2026-08-18

我们将分享两种使用 Stable Audio 3.0 的新方法。我们现在在StableAudio.com 上有一个 DAW 插件和更先进的生成体验。

阿里巴巴推出 AI 音乐生成模型 HappyShrimp 内测

2026-08-17

阅读全文:阿里巴巴推出 AI 音乐生成模型 HappyShrimp...

阿里巴巴人工智能模型下载量突破 3B,超过 Meta、Google

2026-08-15

阅读全文:阿里巴巴 AI 模型下载量突破 3B,超越 Meta,...

以GLM-5为例,研究九章智算云强化学习系统如何实现“训推一致”

2026-08-18

过去几年,大模型竞争的主线训练很清晰:更大的模型、更多的数据和更强的GPU负载。但随着预训练边际收益递减,模型能力缩放正从疯狂的预训练强化学习(强化学习)转变,数学推理、生成、复杂决策、长交互智能体等高阶能力,越来越依赖后训练强化学习(强化学习)激发。强化学习通过生成、执行、反馈和奖励,让模型持续学习推理、规划与纠错的能力。由此,大模型发展从“一次性训练”进入“持续训练”,模型能力...

IJCAI-ECAI 2026开幕:吴佳俊斩获「计算机与思想奖」,SMOTE算法获首届时间检验奖

2026-08-18

经典大奖致敬AI先驱把,14位学者青年站上全新焦点舞台,713篇主会论文脉未来演图进景。

6 个 Agent 组团 Vibe Gaming:自己生成、试玩、修 Bug

2026-08-18

代码能跑≠游戏能玩

首选B级闪充轿车秦MAX正式上市,售价10.99-14.39万元

2026-08-18

8月13日,比亚迪秦MAX正式上市,推出EV与DM-i双动力版本

Show HN:PhysiClaw – 实际操作 iPhone 的人工智能智能体

2026-08-18

阅读全文:Show HN:PhysiClaw – 一种人工智能智能体,可以物理地...

Show HN:Coalent – 一个 LLM 答案缓存,当源文档更改时该缓存会失效

2026-08-18

阅读全文:Show HN:Coalent – 在源文档变更时自动失效的 LLM 答案缓存...

📰 顶级媒体

使用可信数据扩展人工智能智能体

2026-08-12

商业和技术领导者无需相信智能体人工智能的时代已经到来。组织正在迅速采用智能体,很少有高管怀疑该技术改变工作的潜力......

我们仍然不知道人们如何真正使用人工智能

2026-08-18

人工智能研究人员表示,Anthropic 和 OpenAI 等人工智能公司定期发布有关人们如何使用 Claude 和 ChatGPT 等产品的报告,但他们只发布他们希望我们看到的数据。 ...

AI 自动化初创公司 Relay 关闭,员工加入 Google 的 Chrome 团队

2026-08-17

Relay 创始人兼首席执行官 Jacob Bank 表示:“我们有一些非常雄心勃勃的计划来帮助您在 Chrome 中使用人工智能来完成工作,我很快就会分享更多内容。”

OpenAI 为青少年推出了更安全的 ChatGPT — 在青少年开始使用多年后

2026-08-18

ChatGPT for Teens 增加了适合年龄的安全措施、家长控制和学习工具,旨在引导青少年远离有害内容,并避免使用人工智能在作业上作弊。

🎓 学术界前沿

用于城市系统轨迹生成的从粗到细的多分辨率扩散模型

2026-08-18

arXiv:2608.14570v1 发布类型:新 摘要:理解人类移动性对于交通管理、疫情控制和城市规划等广泛的城市应用至关重要。如何...

解释自适应系统中的强化学习决策

2026-08-18

arXiv:2608.14620v1 公告类型:新 摘要:强化学习(RL)已广泛应用于自主和自适应系统。

不成文的基准:抽象感知推理中多模态机器学习的新挑战

2026-08-18

arXiv:2608.14558v1 公告类型:新 摘要:当前的多模态模型在识别静态视觉和听觉内容方面表现出了卓越的能力。然而,他们的抽象能力...

KC-BFPRL:基于双层 Formerpointer 强化学习的知识引导多无人机协作草地恢复

2026-08-18

arXiv:2608.16326v1 公告类型:新 摘要:多无人机(UAV)系统为大规模环境任务提供可扩展的服务平台,例如草原生态系统恢复...

ETHOS:迈向临床多智能体系统的模块化伦理框架

2026-08-18

arXiv:2608.15424v1 公告类型:新 摘要:LLM 的快速采用使得能够集成多模态患者数据的临床多智能体系统(MAS)的开发成为可能。

Jais 2:一系列以阿拉伯语为中心的开放大型语言模型

2026-08-18

arXiv:2608.13580v1 公告类型:新 摘要:Jais 2 是由 MBZUAI、Cerebras 和 Inception 联合开发的一系列以阿拉伯语为中心的开放 LLM,旨在推进以阿拉伯语为中心的语言...

立场:人工智能道德推理的评价仍遗漏了一半

2026-08-18

arXiv:2608.14566v1 公告类型:新 摘要:最近评估 LLM 道德能力的工作主要集中在我们所说的道德价值问题上,即...

BCMT:块式因果记忆变压器

2026-08-18

arXiv:2608.13578v1 公告类型:新 摘要:Transformer 架构依靠密集的自注意力来建模远程依赖关系,但这种机制在...

HarnessEval-W:视觉世界评估的 Agent 化

2026-08-17

阅读完整文章:HarnessEval-W:视觉世界评估的 Agent 化...

CaliBench:视频世界模型的随机动力学是否经过物理校准?

2026-08-17

阅读完整文章:CaliBench:视频的随机动力学...

🔥 社区与工程

Running DeepSeek V4 Flash Q4_K_XL at ~100 tok/s prompt processing on 4× RTX 3060 12GB

2026-08-18

I managed to run the 143–144 GiB DeepSeek-V4-Flash-0731 UD-Q4_K_XL GGUF on four RTX 3060 12GB cards while keeping a 360k–376k context window. Hardware: CPU: Intel Core i9-10920X, 12C/24T RAM: 128 GB D...

Ling 3 的尺寸是否被低估了?

2026-08-18

我正在检查该模型的基准测试,在人工分析的基准测试中,显然比 Qwen3.5 9b 推理要好。我已经将 9b 型号用于各种用途,它非常令人惊叹......

使用 Strands Agents、LeRobot 和 Hugging Face Storage Buckets 从一处进行记录、训练和部署

2026-08-13

阅读全文:使用 Strands Agents、LeRobot 和 Hugging Face Storage Buckets 从一处进行记录、训练和部署...

OlmoEarth 嵌入简介:从 OlmoEarth Studio 导出的自定义嵌入用于下游分析

2026-08-12

阅读完整文章:OlmoEarth 嵌入简介:自定义嵌入...

NVIDIA Nemotron 3.5 Lightning

2026-08-11

NVIDIA Nemotron 3.5 Lightning 现已在 Ollama 上可用。它是一个 300 亿参数(3B 激活)的开放模型,专为持续运行、收集上下文、调用工具并完成多步任务的 Agent 而构建。