博主头像

👤 同一博主

按发布时间查看该博主的全部资讯要点

查看全部博主 →
博主头像

🎬 Cherry Studio V2 来了,超详细攻略 + 真实使用场景分享

🚀 核心观点 Cherry Studio V2.0 完成全面重构,从单纯的聊天客户端升级为具备自主执行能力的 Agent 一站式 AI 工作台。其最大特色在于极高的自由度,支持自由选择模型、配置 Skill/MCP 及联网搜索引擎,并移除了 Agent 只能对接特定端点的限制。 📊 关键事实与功能亮点 基础概况:开源免费的全能 AI 工作站,GitHub Star 数达 48k。V2.0 版本重点强化了 Agent 自主规划、工具调用及文件读写能力。 模型接入与测试:覆盖国内外主流模型及本地推理框架。用户可通过 Postman 或 Cherry Studio 快速测试 API 连通性与推理速度,支持查看 Token 消耗、首次时延及输出速度。 Agent 实战场景: 自动化办公:结合 EXA 搜索引擎(每月2万次免费调用)与 Playwright CLI 技能,可自动搜索并下载电子教材(如人教版物理必修二)。 内容生成:读取本地文件仿照格式编写教学材料,交付 Word/PDF 双格式;利用 KIMI K3 模型生成可交互的 3D HTML 网页(如火车转弯受力分析),支持实时调节参数。 多模型协同写作:对话功能无内置编程提示词干扰,适合纯文字工作。支持一次性勾选十几个模型同时回答,便于对比挑选最佳标题或脚本;具备“对话分支”功能,可保留历史并尝试不同风格,实现工程化管理。 知识库(RAG): 支持全文检索与向量数据库语义匹配两种方案。 配置免费嵌入模型(如 BGE-M3)和重排序模型(如 BGE Reranker V2M3)可提升检索精度,解决关键词不匹配的痛点。 支持 Word、Excel 及 Markdown 目录导入,Agent 可自主调用知识库补充知识。 💡 结论 Cherry Studio V2.0 凭借高自由度的 Agent 配置、多模型并行对比能力及完善的本地知识库体系,成为适合普通人搭建个人 AI 工作流的高效工具,尤其在文档处理、自动化操作及复杂任务规划场景中表现优异。

博主头像

🎬 阿里除夕开源千问3.5,原生多模态,全网第一手实测

📢 核心观点 阿里在除夕当天开源了新一代多模态大模型千问3.5,主打极致稀疏的MoE架构与原生多模态能力。 该模型在编程速度、视觉智能体操作、长视频理解及3D代码生成方面表现突出,性能与千问3基座持平但吞吐量提升显著。 千问3.5支持201种语言,坚持开源全尺寸模型,采用Apache协议,API价格极具竞争力。 📊 关键事实与论据 架构参数:开源版本为397B A17B,总参数量3970亿,激活参数仅170亿,属于极致稀疏MoE架构。 多模态突破:支持原生多模态,在文本和视觉混合数据上联合学习,不依赖编码器,可实现像素级精确定位。 编程效率:在256K长上下文下,解码吞吐量激增19倍;实测中26.1秒完成Agent代码编写,速度极快。 Agent能力:通过视觉识别自动化操作电脑,如删除回收站文件、使用VSCode提交代码至GitHub,任务执行精准且无报错。 视频理解:能理解长达两小时的视频,精准定位事故时间(1分14秒)及足球比赛开球时间(1分59秒),并识别地点(南非德班)。 代码生成:使用Three.js复刻金门大桥3D模型,交付770行代码,效果媲美一线大模型;还能用HTML复刻坦克大战游戏。 语言支持:支持语言数量从119种跃升至201种。 成本优势:阿里云百炼平台每百万token输入低至0.8元,是GPT-5.2的1/15,Gemini 3 Pro的1/18。 💡 结论 千问3.5凭借原生多模态和高效推理,在视觉智能体和复杂任务自动化方面展现出强大潜力。 其开源策略和低廉的API成本,使其成为开发者部署本地模型或调用云端服务的优选方案。 模型在保持高性能的同时,显著提升了推理速度,适合对实时性和多模态交互有高要求的应用场景。

博主头像

🎬 Gemini 3.0 API对接编程实战,是夯还是拉?

📊 核心观点 Gemini 3.0 Pro 在视觉推理、数学测试及屏幕理解方面表现强劲,多项基准测试领先幅度显著。 该模型前端编程能力与审美设计处于顶级水平,但在后端复杂代码理解及综合编程测试(SWE-bench)上略逊于 GPT 5.1 和 Claude 4.5。 提示词工程策略需调整,建议保持简洁,并将具体指令置于上下文末尾以引导模型输出。 🔍 关键事实与论据 API 变更:新增 Think Level 参数替代旧版 Think Budget;引入媒体分辨率参数控制多模态 Token 上限;Function Call 增加签名机制以提升工具调用能力。 定价与配置:上下文窗口与 2.5 Pro 一致,知识截止至 2025 年 1 月,定价较上一代上涨 60%。 实测案例: Java 后端:在 Redis 缓存代码审查中,Gemini 3 未能识别核心逻辑缺陷,表现不如 ChatGPT;在 Kafka 消息队列开发中,存在事务回滚范围过大、JSON 拼接易出错及异步处理不当等问题。 前端开发:成功生成包含昼夜光照变化的 3D 山脉场景、3D 建造游戏及复古风格“你画我猜”游戏,视觉效果与交互体验极佳,仅存在鼠标坐标偏移的小 Bug。 接入流程:需通过 AI Studio 创建 API Key,绑定支付方式(如信用卡)并设置结算信息以获取免费额度(如 300 美元),随后使用 Gemini CLI 进行对接测试。 💡 结论与建议 适用人群:强烈推荐给从事前端开发、UI 设计或需要高审美视觉输出的用户。 不适用场景:主要工作涉及后端编程、复杂系统架构或需要极高代码逻辑严谨性的开发者,建议保留 GPT 5.1 或 Claude 4.5 作为主力模型。 使用技巧:若需验证模型版本,可询问 DeepSeek 最新版本且不联网搜索,若回答正确则为 Gemini 3;引导模型时可采用“友善助理”身份设定以提升回答详细度。

博主头像

🎬 6大MCP协作开发电商业务网站,真实编程场景实测GLM-4.6

🎯 核心观点 海外主流编程工具(如 Cursor、Windsurf)被指基于中国开源大模型 GLM-4.6 微调,以降低成本并提升效率。 GLM-4.6 在复杂后端开发、全栈应用构建及多工具协作场景中表现强劲,具备处理真实业务逻辑的能力。 结合 MCP(Model Context Protocol)工具链,AI 能高效完成从设计稿还原、数据库操作到支付集成的全流程开发。 📊 关键事实与论据 电商网站实战: 集成 Figma、Supabase、Stripe、Replicate 等 6 个 MCP 工具。 成功实现用户注册登录、商品展示、AI 生成商品图及 Stripe 支付流程。 利用视觉理解 MCP 修复了界面中文显示 Bug,并通过联网搜索 MCP 生成 Stripe 集成文档。 订单状态在沙盒环境中从 pending 成功更新为 success。 Java 后端任务: 场景:基于 Spring Boot 实现定时扫描预约表,通过 Kafka 消息队列削峰填谷,触发邮件提醒。 结果:GLM-4.6 在 2 分钟内完成代码编写,结构包含 Controller、Service、Repository 三层。 缺陷:代码采用批量更新状态,存在单条数据异常导致整批失败的风险,建议改为逐条更新。 全栈游戏开发: 使用 Next.js 构建“你画我猜”游戏,调用 Gemini API 进行图像识别。 通过 Context7 MCP 获取最新技术文档,成功更新项目依赖并优化配置。 💡 结论 GLM-4.6 在工具调用能力上表现优异,能熟练配合多个 MCP 工具完成复杂开发任务。 对于纯前端简单页面,当前编程 Agent 已能轻松应对;在后端复杂业务逻辑中,其代码结构工整,但需人工审查细节逻辑(如数据库更新策略)。 该模型在性价比和实际工程落地能力上具有显著优势,适合用于快速原型开发及全栈应用构建。

博主头像

🎬 AI编程,我找到了性价比平替,前后端真实编程场景实测

🎯 核心观点 针对 Claude 模型输出质量下降及高昂定价问题,Kimi K2 是具备高性价比的编程模型平替方案。 Kimi K2 在 Agentic Coding 能力、工具调用及结构化输出方面表现优异,适合复杂长任务。 在 AI 辅助编程中,人类应侧重系统架构设计与意图纠正,而非陷入代码细节,以实现效率最大化。 📊 关键事实与论据 性能与成本:Kimi K2 上下文长度达 250k,超越 Claude Sonnet 4;API 价格仅为后者的六分之一。实测后端 Java 任务消耗约 120 万 Token,成本约 3 元,远低于 Claude 的 3.78 美元。 工具调用测试: Chrome MCP:成功定位 GitHub 上 Star 数最高的开源项目(2.6k Star),展现强组合调用能力。 Excel MCP:准确提取 1-9 月编程语言趋势数据(如 Python 5 月趋势 25.35),结构化输出能力强。 后端实战:在 Spring Boot 项目中实现 Kafka 消息队列与邮件提醒功能,耗时不到 3 分钟。虽出现序列化及 Offset 提交冲突报错,但经人工纠正后成功调通。 前端对比:在“你画我猜”案例中,Kimi K2 正确引用 Tailwind CSS v4,文件结构工整,评分 95 分;优于 Claude 4 Sonnet(交互缺陷)、Gemini 2.5 Pro(画板透明 Bug)及 GLM 4.5(后台逻辑未跑通)。 💡 结论与建议 适用场景:适合需要低成本处理复杂后端逻辑、长上下文任务及多工具协同的开发者。 操作建议: 配置时需区分环境变量名与具体值(如 Codex 配置)。 遇到 AI 偏离意图(如过度设计工厂类)时,应立即打断并明确纠正方向。 利用 Kimi K2 Turbo 限时半价活动,可显著降低编程辅助成本。

博主头像

🎬 无限免费Claude Code,免费模型有满血版几成功力?

🛠️ 免费接入方案与配置 核心工具:使用开源项目 `cloudcode router` 将任意大模型 API 接入 Claude Code,以替代昂贵的官方订阅。 支持模型: 千问 Code:通过 ModelScope 社区获取,每日提供 2000 次免费 API 调用。 Gemini:需通过 Google AI Studio 申请 Key,推荐配置 Gemini 2.5 Flash 为执行模型,Gemini 2.5 Pro 为思考模型;国内用户需配置中转地址。 GLM 4.5:通过 OpenRouter 接入,新注册用户可获 500 万免费 Token,至尊包提供 1 亿 Token 额度。 原生 Claude:通过 OpenRouter 充值 Credits 后接入 Claude Sonnet 模型。 配置步骤:安装 Node.js 及 Claude Code,创建 `config.json` 配置文件,填入对应提供商的 API Key 及模型名称,修改端口(如 23456)以解决权限冲突,最后通过 `ccr start` 启动服务。 📊 编程能力评测对比 测试项目:使用 Next.js 开发“你画我猜”网页游戏,需调用后台 API 识别图像。 评分结果: Claude (90分):功能完整,交互逻辑最佳,但存在缺少提交按钮的小瑕疵,成本约 0.7 美元。 Gemini (85分):功能跑通,但画板背景透明导致识别困难,需手动添加白色背景;页面美观度一般。 千问 Code (80分):功能跑通,但 CSS 未生效(缺少 Tailwind 配置),且出现重复循环调用工具的问题。 GLM 4.5 (75分):页面美观且新增玩法,但后台逻辑未实现(使用模拟返回),项目框架非脚手架生成且写法老旧。 结论:各模型差距不大,Gemini 和千问 Code 表现较好;若使用 Gemini 2.5 Pro 可配置负载均衡以增加免费额度。 💡 高效使用技巧 关键命令: `/init`:通读项目并生成 `cloud.md` 知识文件,帮助 AI 快速了解项目结构。 `/compact`:压缩历史对话记录,减少 Token 消耗。 `/clear`:清除上下文,确保新任务不受旧内容干扰。 模式切换:按 `Alt+M` 切换普通模式(需人工审阅)、AutoAccept 模式(自动接受修改)和 Plan 模式(仅规划不修改)。 多模态交互:支持拖入图片进行视觉分析(如修改按钮颜色),支持读取网页内容并总结翻译。 IDE 集成:在 VS Code 中安装 Claude Code 插件,通过 `/ide` 命令打通,实现代码修改的可视化审阅。 联网搜索:若模型支持(如 Gemini),可直接调用网络搜索工具获取最新信息(如 Next.js 15.4 版本)。

博主头像

🎬 新赛博大善人诞生了! 中国区友好的免费CDN,无限流量,DDoS防护。比cloudflare更好用

🎯 核心观点 腾讯云旗下的 Edge One(爱之万)提供了一款免费且更适合全球访问的网站安全加速服务,被视频内容称为“新的赛博大善人”。 相比 Cloudflare,Edge One 免费套餐在功能覆盖上更具优势,特别是针对中国大陆地区的访问优化及多项付费功能的免费化。 该服务旨在解决网站加载慢、浏览器显示不安全及黑客攻击等问题,适合具有全球访问流量且需要兼顾国内用户体验的网站。 📊 关键事实与论据 性能对比数据:根据谷歌研究,页面加载时间从 1 秒增加到 3 秒,访客流失率增加 32%。 实测延迟提升: 直连服务器:国内平均访问速度 0.06 秒,海外 0.85 秒。 使用 Edge One CDN:国内平均访问速度降至 0.05 秒,海外降至 0.16 秒。 功能免费化对比: CNAME 接入:Edge One 免费套餐支持,Cloudflare 需付费商业版。 自有证书上传:Edge One 免费套餐支持,Cloudflare 需付费。 自定义 404 错误页面:Edge One 免费套餐支持,Cloudflare 需高级会员。 修改 HTTP 响应头(如跨域访问):Edge One 免费套餐支持,Cloudflare 需付费。 基础服务包含:CDN、DNS、DDoS 防御、边缘函数、静态网页部署等。 接入要求:若需包含中国大陆地区访问,域名需在中国备案;支持 NS 和 CNAME 两种接入方式。 🛠️ 结论与适用建议 适用人群:拥有全球访问流量、受困于 Cloudflare 国内节点绕行导致的高延迟问题、且预算有限的个人开发者或小型网站运营者。 核心优势:在免费层级提供了更完善的全球加速能力(尤其是国内节点直连)和更高级的安全防护自定义规则(如区域拦截、响应头修改)。 注意事项: 免费套餐官方不提供 SLA 服务条款,具体以官网为准。 配置 HTTPS 时,若服务器未配置证书,回源协议需选择 HTTP。 需通过特定渠道领取免费套餐激活码进行兑换。

博主头像

🎬 全球最强开源模型Qwen3,全场景实测+本地部署教程 #ai #人工智能 #通义千问 #mcp

🚀 核心观点 阿里开源千问3大模型,被视为开源界重磅产品,支持思考与非思考模式一键切换,平衡成本与质量。 千问3提供从0.6B到235B的全尺寸开源模型,覆盖移动端至高性能服务器,本地部署门槛显著降低。 在编程、语言理解及多模态生成等全场景实测中,千问3表现达到一线顶级大模型水平,部分场景优于竞品。 基于Ollama框架,单张4090显卡可流畅运行32B参数模型,显存占用低,适合个人开发者本地部署。 📊 关键事实与论据 模型规格:训练数据达306万亿Token,支持199种语言;旗舰版235B-A22B为混合专家模型,激活参数仅22B,生成速度快。 编程实测: 算法:在LeetCode最新Hard/Medium题目中,千问3在30分钟内一次性通过所有测试,代码简洁且逻辑正确。 前端/游戏:生成HTML动态网页具备科技感;使用Pygame实现超级玛丽游戏,具备Roguelike随机地图特性,优于GPT-4o、DeepSeek及Gemini 2.5 Pro的表现。 3D交互:使用Three.js生成3D迷宫小球运动,虽初版迷宫简单且WASD反向,但经追问优化后逻辑正常,碰撞与惯性处理优于DeepSeek R1。 语言与创意:在“批判现实”风格词汇解释中,对“Up主”、“程序员”等角色的描述风趣且深刻;能识别并解释西非语言卡布维尔迪亚努语。 本地部署数据: 8B模型:显存占用7.4GB,响应速度快。 14B模型:显存占用11.4GB,输出速度约30+ Token/s。 32B模型:显存占用20.4GB,在4090显卡上运行流畅,速度良好。 💡 结论与建议 适用人群:适合追求高性能、低延迟及数据隐私的开发者、极客及企业用户。 部署建议: 推荐工具:Ollama(Windows/Linux通用),配合Cherry Studio等客户端使用。 硬件参考:4090显卡(24GB显存)可完美运行32B模型,仍有显存余量;8B/14B模型对硬件要求更低,适合普通PC。 操作要点:通过API参数或网页按钮切换思考模式;简单问题用非思考模式提速,复杂推理用思考模式提质。 综合评估:千问3在开源模型中具备极强的竞争力,尤其在代码生成和长文本推理方面表现突出,本地部署体验优于多数闭源API方案。

已显示 8 / 8 篇