标签:DeepSeek

业余杂谈

千问发布 Qwen-Image-3.0 图像生成,进步明显!

herman 3周前 (07-22) 125浏览

千问发布 Qwen-Image-3.0 图像生成,进步明显! 千问 Qwen 是国内少有的多模态比较齐全的模型厂商了,像 DeepSeek、Kimi 等模型,多模态要不是没有,在不是就比较弱,也或者是在路上。 于是,我有时候处理图片就在...

业余杂谈

Kimi K3 也要来了?2.5 万亿参数 + 原生多模态?

herman 4周前 (07-15) 201浏览

Kimi K3 也要来了。就在昨天晚上(7 月 14 日),一张“Kimi K3 发布限时充值活动”的页面截图在 AI 圈子里疯传。页面显示 7 月15 日至 8 月 11 日充值送赠券,但仅仅挂了几十分钟就被紧急下架。与此同时,月之暗面内部员工在...

JAVA

一行 JS 代码让 10 年的 SaaS 老系统秒增 AI 功能

herman 4周前 (07-14) 151浏览

今年以来 Agent 大火,以至于不少系统都在求变。 新系统还好说,但不少老系统也想凑热闹。这些老系统,有的用的是 JDK 6、有的是 JDK 8。搞 Java 的都知道,Spring AI 这类框架都是 JDK 17 起步的,老版本的 JD...

业余杂谈

Claude Sonnet 5 发布,Fable 5 和 Mythos 5 解禁

herman 1个月前 (07-01) 192浏览

AI 圈流传着一句梗,只要你学的慢,就可以不用学。因为半年后,可能就淘汰了。 你看年初的 OpenClaw 类龙虾产品,现在没啥热度了。对应的模型厂商变化也很快,以 Claude 发布的 sonnet 等模型为例,版本升级太快,半年前的模型半...

业余杂谈

DeepSeek 开源的 DSpark,推理加速 80%,没上 Github 周榜

herman 1个月前 (06-30) 234浏览

国外的模型强,我们很少有看到相关技术或论文方面的突破。不知道,这是不是一个深水区,以至于大多数自媒体只能在版本发布上下功夫。 国内的模型发布,好像也就 DeepSeek 的相关论文每次能引起网友的注意。这不,这两天 DSpark 刷屏了,当行...

业余杂谈

GPT 5.6 震撼发布,性能比肩 Claude Mythos 5

herman 2个月前 (06-27) 226浏览

前段时间,Claude 发布的两款最强模型由于某些原因还没有解禁,OpenAI 就着急着抢用户了。 这不,就在昨天,6 月 26 日,OpenAI 悄悄放出了一个大招,新一代模型 GPT-5.6 系列正式发布了。 虽然,GPT-5.6 ...

业余杂谈

DeepSeek V4.1 灰度内测,代码能力大幅提升

herman 2个月前 (06-17) 418浏览

今天有点忙,全忙着和产品聊需求去了,就不写技术了。 AI 的天可能要变了。Claude Fable 5 被迫下线了,然后我们这边的智谱 GLM 5.2 真的很顶,在多个榜单上都“遥遥领先”。在某些领域还和 Claude 4.8 和 ChatG...

业余杂谈

ChatGPT、Claude、Codex 集体故障同一天宕机

herman 2个月前 (06-03) 243浏览

狡兔三窟,用 AI 也得一样。 今年以来,在使用 AI 方面已经发生过不少事故了。严重的是账号被封禁,个人的或团体的都有,甚至有些小公司立马就无法营业了。 所以,有一些群体就开始了“多备份”,多个厂商的 AI 同时用,预防出现服务故障后...

业余杂谈

10.4 万 Star,MarkItDown 再次登顶

herman 2个月前 (06-02) 395浏览

很少有开源项目能够多次登顶 GitHub 周榜的,而微软开源的 MarkItDown 项目就是其中之一。 这个将 PDF、Word、PPT 甚至音频视频转成 Markdown 的 Python 工具,凭什么在发布半年后还能单周暴涨 1 万星?...