指南建议按工作负载选模型:高难度推理可选 GPT‑6 Astra,复杂编程、研究和计算机使用任务可选 GPT‑6.1 Sol,重复性任务可选 GPT‑6 Luna。提示词应说明目标、受众和限制;日常问答也无需默认使用最高推理强度。
全部 AI 动态
10月3日
9月30日
教程用合成理赔文档搭建问答助手,通过 AgenticRetrieveStream 处理多轮提问,并用元数据筛选和来源引用核对答案。文中报告的 40 题评测使用 Retrieve 和 RetrieveAndGenerate,而非 AgenticRetrieveStream;预期来源的检索召回率为 90.5%。
AWS 介绍了用 Runtime Instances 搭建三智能体音乐制作流程的方法:智能体通过同一会话 ID 共享实例和文件系统,依次生成、处理并检查音频。会话最长可持续 14 天,但恢复时需落在原可用区,才能重新挂载持久化卷。
AWS 的教程介绍如何用具体需求、业务背景和示例改进 Amazon Quick 的提示词,并给出 CRISPE 框架来组织复杂请求。文章还以 RFI 问卷处理为例,说明如何从格式不一的 Excel 工作簿提取问题并输出结构化 CSV;针对 Quick 各组件的技巧留待系列第二篇展开。
AWS 分享一套合同分析架构:用 Claude Sonnet 4.6 提取 PDF 中的字段,由 Claude Haiku 4.5 独立核验,并将结果存入数据库,以支持跨合同汇总查询。两模型对签名状态有分歧时,系统调用 Amazon Textract;作者称,其准确率测试仅覆盖 20 份合同,结果会随合同格式和字段复杂度变化。
9月29日
AWS 发布部署示例:使用 vLLM-Omni 容器运行 Qwen3-TTS,通过 SageMaker AI 的双向连接发送文本,并在完整回复生成前接收、播放语音片段。示例附带 Gradio 客户端;部署端点需要相应实例配额,运行中的 GPU 端点会持续计费。
AWS 展示了用同一 vLLM-Omni 容器部署两个端点的流程:FLUX.2-klein-4B 实时生成图片,再由 Wan2.1-VACE-1.3B 异步生成视频,成品 MP4 存入 Amazon S3。示例提供命令行流程和可选的 Streamlit 界面。
9月28日
AWS 给出将 Amazon Textract 适配器从训练环境推进到生产环境的流程,并提供 CloudFormation、Terraform 模板及文档预分类方案。跨账户复制仍需提交 AWS Support 工单,且只转移训练后的模型权重;将适配器 ID 存入 Parameter Store 后,可在不重新部署应用的情况下更新生产引用。
9月26日
GitHub 介绍了在 Copilot app 中用 /create-canvas 创建工作画布的方法:用户描述工作流程、界面操作及代理任务,代理便会生成界面并在侧边栏打开。画布支持用户与代理双向更新,创建后还可保存为个人或团队使用的扩展。
开发者现可将 Qwen3-TTS-12Hz-1.7B-Base 从 SageMaker JumpStart 部署到托管实时推理端点,用几秒钟的参考录音及其文字稿克隆说话人的声音。教程使用单张 24 GB NVIDIA L4 GPU,并指出调用时须指定语音合成路由;模型还支持以一种语言的录音生成另一种语言的语音。
9月25日
Thariq Shihipar 在 Claude Code 使用指南中建议:快速迭代可用低 effort,遇到需要验证或处理边界情况的任务则提高档位。其内部测试中,Fable 5.1 完成一项 HTML 净化任务的次数从低档的 1/5 升至 xhigh 的 5/5;这些数字来自每项任务五次尝试,不能直接对照公开榜单。
教程以四个 AWS 账户的参考实现为例:业务团队在各自账户中将数据封装为 MCP 工具,中央账户的代理通过单一 Gateway 查询。工具只返回请求所需结果,原始数据集仍留在所属账户;示例使用 Okta 身份验证和 Gateway 层的逐用户授权。
9月24日
教程展示如何让本地运行的 OpenCode 通过 Amazon Bedrock Converse API 调用开放权重模型,并为规划、代码生成等任务配置不同模型。示例使用 Kimi K3、GPT-OSS 120B 和 Nemotron 3 Super 120B;使用前需开通 Bedrock 访问权限并获得相应模型的访问权限。