尧图网络 高端网站定制 · 原创设计
免费咨询热线
400-888-6620
免费获取方案
API实践第一篇:三个配置解决大部分调用问题无标题】
三个配置解决大部分调用问题Python调AI接口总超时改了三个地方没再报过错写了个接AI的项目踩了一堆坑。超时、429、流式中断查日志发现不是平台问题是自己客户端配置没搞对。记录一下。一、超时超时设太短是最常见的坑。设30秒长文本生成跑不完就断。改120秒。设长不代表每次都等那么久只是给长任务留余地。模型10秒出结果10秒就拿到了。pythonfrom openai import OpenAIimport httpxclient OpenAI(base_urlhttps://api.openstarry.com/v1, api_keysk-xxx, timeouthttpx.Timeout(connect10.0, read120.0))场景 读超时短问答 30秒一般对话 60秒代码生成/长文 120秒超长文本 300秒二、流式不开 stream等全部生成完才返回屏幕空白好几秒。加上 streamTrue第一个字出来就感觉在响应。实际耗时没变体感差很多。pythonstream client.chat.completions.create(modelglm-5.2, messages[{role: user, content: 介绍一下量子计算}], streamTrue)for chunk in stream:if chunk.choices[0].delta.content: print(chunk.choices[0].delta.content, end, flushTrue)对话场景开批处理可以关。三、重试429和5xx可以重试4xx重试没用。pythonimport timeimport randomdef chat_with_retry(messages, max_retries3):retryable {429, 500, 502, 503, 504} for attempt in range(max_retries 1): try: return client.chat.completions.create( modelglm-5.2, messagesmessages ) except Exception as e: status getattr(e, status_code, None) if status in retryable and attempt max_retries: wait (2 ** attempt) random.uniform(0, 1) time.sleep(wait) else: raise退避间隔1s → 2s → 4s。加随机抖动避免重试风暴。最多三次。我用的APIOpenStarry国内的聚合服务。兼容OpenAI换base_url和key就行。总结超时设长、开流式、加重试。这三件事搞定大部分调用问题就没了。
RELATED

相关推荐

我的VB Coding之路 - AI编码实战演进

我的VB Coding之路 - AI编码实战演进

一、背景:我们为什么要使用AI编码? 1.1. 行业与业务背景 从23年开始,随着基础大模型的突破,主流代码工具的迭代周期越来越快,这些工具的创新持续推动整个研发效能提升。 从最初的编译器代码补全、到Github Copilot代…

📅 2026/9/8 2:17:05
光谱智能革命:YOLO多光谱检测的工业级效能突破

光谱智能革命:YOLO多光谱检测的工业级效能突破

光谱智能革命:YOLO多光谱检测的工业级效能突破 【免费下载链接】ultralytics Ultralytics YOLO26, YOLO11, YOLOv8 — object detection, instance segmentation, semantic segmentation, image classification, pose estimation, object tracking 项目地址: http…

📅 2026/8/23 17:20:58
mspm0g3507 adc直流测量

mspm0g3507 adc直流测量

1. import一个empty2. +adc3. 采样时间越长,精度越高4. mem0中断5. #include "ti_msp_dl_config.h"volatile bool ADC_Flag; volatile double ADC_Val;int main(void) {SYSCFG_DL_init();NVIC_EnableIRQ(ADC12_0_INST_INT_IRQN);while (1) {AD…

📅 2026/8/23 17:20:57
MORE NEWS

更多资讯

📰

DeepSpeed-Ulysses 深度解析:用 All-to-All 序列并行撑起百万 Token 超长序列训练

DeepSpeed-Ulysses 深度解析:用 All-to-All 序列并行撑起百万 Token 超长序列训练 【免费下载链接】DeepSpeed DeepSpeed is a deep learning optimization library that makes distributed training and inference easy, efficient, and effective. 项目地址: ht…

📰

Taichi 贡献指南:从源码构建、开发环境搭建到 RFC 流程的完整参与手册

Taichi 贡献指南:从源码构建、开发环境搭建到 RFC 流程的完整参与手册 【免费下载链接】taichi Productive, portable, and performant GPU programming in Python. 项目地址: https://gitcode.com/GitHub_Trending/ta/taichi 导读 本文基于 Taichi 仓库根目…

📰

WezTerm 色彩调色实战:`color:adjust_hue_fixed()` 色相旋转与色板生成完全指南

WezTerm 色彩调色实战:color:adjust_hue_fixed() 色相旋转与色板生成完全指南 【免费下载链接】wezterm A GPU-accelerated cross-platform terminal emulator and multiplexer written by wez and implemented in Rust 项目地址: https://gitcode.com/GitHub_Tre…

📰

第22~26天 线性表

一.线性表1.线性结构特点1.存在唯一的“第一个”元素2.存在唯一的“最后一个”元素3.除第一个外,每个元素只有一个前驱4.除最后一个外,每个元素只有一个后驱图是一种非线性数据结构,其他的栈、队列和数组都是线性结构。顺序表时间复杂度&…

📰

DDR5省电/掉电模式详解与DDR4的差异,Power Down Mode章节

1:Power Down ModePower Down Mode模式是DDR5的初级省电/掉电模式,在Power Down Mode模式期间用户数据得以保证。因为需要定时退出省电模式进行刷新操作。DDR5取消 DDR4 的 CKE 硬件引脚,全部依靠命令编码实现进入 与退出省电模式(Power Down…

📰

Comprehensive Rust 生命周期实战:用 Rust 手写一个零拷贝 Protobuf 二进制解析器(附完整解答与测试)

Comprehensive Rust 生命周期实战:用 Rust 手写一个零拷贝 Protobuf 二进制解析器(附完整解答与测试) 【免费下载链接】comprehensive-rust This is the Rust course used by the Android team at Google. It provides you the material to q…

TODAY

今日更新

THIS WEEK

本周精选

THIS MONTH

本月热门

读完文章,想聊聊您的网站?

告诉我们您的行业与需求,资深顾问一对一梳理方案与报价,全程免费。

📞 💬