記事とガイド

コーディングAI

Claude API 中継局のガイド、検出の仕組み、LLM API の実測ノウハウ

全 16 件の記事

CCTest · Blog
LinkedInが複数エージェントでAIコードレビューを大規模化
コーディングAI
cctest.ai
コーディングAI

LinkedInが複数エージェントでAIコードレビューを大規模化

LinkedInは既製のAIレビューツールをそのまま導入するのではなく、複数のレビューエージェントと組織固有のルールを組み合わせた基盤を構築した。狙いはコメント数の最大化ではなく、幻覚や低価値な指摘を抑え、開発者に採用されるレビューを増やすことにある。

続きを読む
CCTest · Blog
Uncle BobのAI開発実験:逐行レビューを減らしても、設計は人間の仕事
コーディングAI
cctest.ai
コーディングAI

Uncle BobのAI開発実験:逐行レビューを減らしても、設計は人間の仕事

Uncle Bobは、実装をAIエージェントに任せ、人間は自動化された品質管理とアーキテクチャ判断に集中する開発方法を試している。レビュー負担は減らせるが、システム構造や業務コンテキストの判断まで置き換えることはできない。

続きを読む
CCTest · Blog
LEGO-RL、ネイティブなコーディングHarnessを強化学習に接続
コーディングAI
cctest.ai
コーディングAI

LEGO-RL、ネイティブなコーディングHarnessを強化学習に接続

LEGO-RLは、実際のコーディングエージェントが使うHarnessを大きく改変せず、方策勾配による強化学習へ接続する枠組みです。Qwen3.5-35B-A3Bを3種類のHarnessで学習し、SWE-bench Verifiedのスコアを向上させました。

続きを読む
CCTest · Blog
Prime Agent がオープンソース化:自己改善を志向するプログラミング Agent
コーディングAI
cctest.ai
コーディングAI

Prime Agent がオープンソース化:自己改善を志向するプログラミング Agent

Prime Intellect は、プログラミング向け Agent Harness である Prime Agent をオープンソース公開した。Opus 5 と組み合わせた結果、ARC-AGI 3 で 95.5% RHAE Best@1 に到達し、ARC が示す人間専門家ベースラインをわずかに上回ったとされる。

続きを読む
CCTest · Blog
Frontis-MA1:機械学習エンジニアリングで AI の自己改善を検証する
コーディングAI
cctest.ai
コーディングAI

Frontis-MA1:機械学習エンジニアリングで AI の自己改善を検証する

FrontisAI は、AI が AI 開発プロセスを改善する能力を研究するための OpenMLE と、35B パラメータの Frontis-MA1 を発表した。実行可能な MLE タスクを使い、コードの生成・改善・デバッグ・交叉を長期探索に組み込む点が特徴だ。

続きを読む
CCTest · Blog
コード生成AIを「正しい」だけでなく「速い」プログラムへ導く強化学習
コーディングAI
cctest.ai
コーディングAI

コード生成AIを「正しい」だけでなく「速い」プログラムへ導く強化学習

この論文は、コードモデルに正解するだけでなく実行速度の速いプログラムを生成させるための強化学習を扱っている。実行時間を報酬に加えるだけでは不十分で、計測ノイズや報酬の疎さ、GRPO の不安定性が大きな障害になる。

続きを読む
CCTest · Blog
人間中心から Agentic Code Review へ:AI はレビューを速くするが、品質向上は限定的
コーディングAI
cctest.ai
コーディングAI

人間中心から Agentic Code Review へ:AI はレビューを速くするが、品質向上は限定的

207 件の GitHub プロジェクトと 102 万件のレビュー済み Pull Request を分析した研究は、AI Agent の参加がレビュー判断を速める一方で、品質改善には一貫した効果が見られないと報告している。

続きを読む
CCTest · Blog
AWS 版 Claude App Gateway、AI コーディングを企業統制の段階へ
コーディングAI
cctest.ai
コーディングAI

AWS 版 Claude App Gateway、AI コーディングを企業統制の段階へ

AWS 向け Claude App Gateway が公開され、Claude Code と Claude Desktop に自社運用型の制御プレーンが提供される。企業は認証、ポリシー、ルーティング、監視、コスト上限をサーバー側で一元管理できる。

続きを読む
CCTest · Blog
OpenAI初の自社ハードはCodex向け小型キーボード
コーディングAI
cctest.ai
コーディングAI

OpenAI初の自社ハードはCodex向け小型キーボード

OpenAIの初の自社ブランドハードウェアは、スマートフォンでもAIコンパニオン端末でもなく、Codexユーザー向けの小型プログラマブルキーボードだった。Work Louderとの協業で設計され、価格は230ドルとされている。

続きを読む
CCTest · Blog
Linus、Linux開発でのAI利用を擁護「嫌ならForkすればいい」
コーディングAI
cctest.ai
コーディングAI

Linus、Linux開発でのAI利用を擁護「嫌ならForkすればいい」

Linuxカーネル開発にAIコーディングツールを受け入れるべきかをめぐり、Linus Torvalds氏が明確に賛成の立場を示した。焦点はAIそのものではなく、品質、誤検知、メンテナー負担をどう管理するかに移っている。

続きを読む
CCTest · Blog
GitHub プロジェクトはエージェント型コーディングツールをどう採用しているのか
コーディングAI
cctest.ai
コーディングAI

GitHub プロジェクトはエージェント型コーディングツールをどう採用しているのか

arXiv の新しい研究は、2361 件の人気 GitHub リポジトリを分析し、エージェント型コーディングツールの利用が広がり始めている一方で、集中的な活用はまだ一部のプロジェクトに限られることを示した。

続きを読む
CCTest · Blog
生成中の AI コードにコンパイラが助言する「生成的コンパイル」
コーディングAI
cctest.ai
コーディングAI

生成中の AI コードにコンパイラが助言する「生成的コンパイル」

arXiv の新論文は、AI がコードを生成している途中でコンパイラのフィードバックを使う「生成的コンパイル」を提案している。対象は Rust のような静的意味論が厳格な言語で、生成後の修正だけでは遅いという課題に取り組む。

続きを読む