排序
小老板别再烧投放了:用AI把写文案剪视频回客户的活干快10倍
小老板最贵的从来不是投放预算,而是每天写文案、剪视频、回客户被悄悄耗掉的时间。用AI把这三件重复活干快十倍,把省下的力气留给真正赚钱的选品与成交。
OpenAI开放Agents API:把Codex拆成云服务
OpenAI单日推出Agents API、GPT-Live-1 API、Data agent与ChatGPT for Financial Services四条产品线,Agents API开放公测,智能体能力变为开箱即用的云服务。
GPT-6 Astra 算力告急:OpenAI 暂停 ChatGPT Pro 新用户
OpenAI暂停ChatGPT Pro新用户注册以保GPT-6 Astra算力,折射AI推理需求激增与算力供给瓶颈的尖锐矛盾。
DeepSeek V4.1 Flash内测:原生多模态实测破500 tokens/s
DeepSeek V4.1 Flash中间版本开启内测,原生支持多模态,开发者实测最高输出速度达507 tokens/s,计费与V4 Flash相同,9月10日自动下线。
面壁智能开源MiniCPM5-2B:4B以下AA榜单综合第一
面壁智能联合OpenBMB开源MiniCPM5-2B,AA榜单4B以下综合第一,智能体指标约为同级模型10倍,已与英特尔、瑞芯微、Arm完成Day0适配。
AI模型疲劳来了:四大厂一周密集发模型
9月初四大厂一周内密集发模型,CNBC造词「模型疲劳」;同批公司逾1100名员工联名请政府为前沿AI踩刹车,Gartner预计2026年AI支出达2.59万亿美元。
Groq 3 LPX量产:3400 tokens/s 为Agent提速
NVIDIA于2026年9月将Groq 3 LPX推理加速器推进全面量产,适配Vera Rubin NVL72,Gemma 4 31B上达3400输出词元每秒,为Agentic AI带来约4倍提速,Nebius率先采用。

























