AirAi 生态合作计划:拿出 10,000 美元额度,赞助还在做东西的人
...
0. 背景:账单是怎么爆的我做几个 side project,早期要么咬牙买官方 $20/mo 订阅,要么硬扛国际信用卡被拒。月底算账发现两件扎心的事:80% 的请求是摘要、分类、格式化这类轻活,用最贵的模型跑纯属浪费;订阅是固定成本——调用少的时候亏,调用多的时候又不够用。...
我们用Claude 3 Opus处理跨境报关单识别,省了60%人工复核成本,但踩了3个坑...
Claude Fable 5 是今天 AI 该领域的核心热点,这个「神话级」模型性能非常出色,吸引了无数的关注。Andrej Karpathy 称其「非常令人兴奋」,是「配得上大版本升级的跃迁式进步」,与去年 11 月 Claude 4.5 所带来的提升属于同一水平。SWE-bench Pro 编程基准,Fable 5 拿到了 80.3% 得分,超越 Opus 4.8 整整 11 一个百分点。拥有一个 5000 万行代码的 Ruby 在代码库中,它在一天内完成了全库迁移,如果将同样的工作量交给人类团队,需要两个多月的时间。...
Voice AI,是通用大模型之外的另一条故事线。 当所有人都在盯着通用大模型时,Voice AI 这条相对安静的赛道里,也开始出现一些值得注意的新模型。 键盘正在失去它的「统治地位」。 过去两年,OpenAI 推出了 Realtime API,Google 做出了 Gemini Live,国内的大模型公司也几乎都开始布局 Voice AI。越来越多的人开始相信,当 Agent 真正进入工作流之后,语音会成为比键盘更自然的上下文入口。 如果 Agent 想真正进入工作流,它首先要学会听懂这些声音。而这背后对应的第一层能力,就是 ASR(自动语音识别)。 衡量 ASR 水平,业内最常引用的是 Hugging Face 的 Open ASR Leaderboard,核心指标是词错误率(WER),数字越低,识别越准。...
没有更多了